Entrada más barata
- 1GLM-4.7-FlashXZ.ai$0.070por millón de tokens
- 2Qwen3.5 FlashAlibaba$0.100por millón de tokens
- 3GPT-4o MiniOpenAI$0.150por millón de tokens
- 4GLM-4.5-AirZ.ai$0.200por millón de tokens
- 5GPT-5.6 LunaOpenAI$0.200por millón de tokens
Cada tarifa de esta página se ha leído de la propia página de precios del proveedor el 22 de agosto de 2026. Compara los precios de entrada, caché y salida de 56 modelos de 11 proveedores y luego introduce tus volúmenes de tokens para ver cuánto costaría una sola petición en cada uno.
Haz clic en una cabecera de columna para ordenar.
| por 1 M | por 1 M | por 1 M | Recuento | por petición | ||
|---|---|---|---|---|---|---|
| GPT-5.6 Sol1OpenAI | $4.00 | $0.400 | $20.00 | 1M | exacto | $0.060 |
| GPT-5.6 Terra1OpenAI | $2.00 | $0.200 | $12.00 | 1M | exacto | $0.032 |
| GPT-5.6 Luna1OpenAI | $0.200 | $0.020 | $1.20 | 1M | exacto | $0.00320 |
| GPT-5.51OpenAI | $5.00 | $0.500 | $30.00 | 1M | exacto | $0.080 |
| GPT-5.41OpenAI | $2.50 | $0.250 | $15.00 | 1M | exacto | $0.040 |
| GPT-5.4 mini1OpenAI | $0.750 | $0.075 | $4.50 | 400K | exacto | $0.012 |
| GPT-5.4 nano1OpenAI | $0.200 | $0.020 | $1.25 | 400K | exacto | $0.00325 |
| GPT-5.11OpenAI | $1.25 | $0.125 | $10.00 | 400K | exacto | $0.022 |
| GPT-4.11OpenAI | $2.00 | $0.500 | $8.00 | 1M | exacto | $0.028 |
| GPT-4o1OpenAI | $2.50 | $1.25 | $10.00 | 128K | exacto | $0.035 |
| GPT-4o Mini1OpenAI | $0.150 | $0.075 | $0.600 | 128K | exacto | $0.00210 |
| Claude Fable 52Anthropic | $10.00 | $1.00 | $50.00 | 1M | est. | $0.150 |
| Claude Opus 52Anthropic | $5.00 | $0.500 | $25.00 | 1M | est. | $0.075 |
| Claude Opus 4.82Anthropic | $5.00 | $0.500 | $25.00 | 1M | est. | $0.075 |
| Claude Opus 4.72Anthropic | $5.00 | $0.500 | $25.00 | 1M | est. | $0.075 |
| Claude Opus 4.62Anthropic | $5.00 | $0.500 | $25.00 | 1M | est. | $0.075 |
| Claude Opus 4.52Anthropic | $5.00 | $0.500 | $25.00 | 200K | est. | $0.075 |
| Claude Sonnet 52Anthropic | $2.00 | $0.200 | $10.00 | 1M | est. | $0.030 |
| Claude Sonnet 4.62Anthropic | $3.00 | $0.300 | $15.00 | 1M | est. | $0.045 |
| Claude Sonnet 4.52Anthropic | $3.00 | $0.300 | $15.00 | 200K | est. | $0.045 |
| Claude Haiku 4.52Anthropic | $1.00 | $0.100 | $5.00 | 200K | est. | $0.015 |
| Gemini 3.1 Pro3Google | $2.00 | $0.200 | $12.00 | 1M | est. | $0.032 |
| Gemini 3.7 FlashGoogle | $0.750 | $0.075 | $3.75 | 1M | est. | $0.011 |
| Gemini 3.5 FlashGoogle | $1.50 | $0.150 | $9.00 | 1M | est. | $0.024 |
| Gemini 3.5 Flash-LiteGoogle | $0.300 | $0.030 | $2.50 | 1M | est. | $0.00550 |
| Gemini 2.5 Pro3Google | $1.25 | $0.125 | $10.00 | 1M | est. | $0.022 |
| Grok 4.64xAI | $2.00 | $0.500 | $6.00 | 500K | est. | $0.026 |
| Grok 4.54xAI | $2.00 | $0.300 | $6.00 | 500K | est. | $0.026 |
| Grok 4.34xAI | $1.25 | $0.200 | $2.50 | 1M | est. | $0.015 |
| Grok Build 0.14xAI | $1.00 | $0.200 | $2.00 | 256K | est. | $0.012 |
| DeepSeek V4 Pro5DeepSeek | $1.32 | $0.044 | $3.96 | 1M | est. | $0.017 |
| DeepSeek V4 Flash5DeepSeek | $0.440 | $0.014 | $1.32 | 1M | est. | $0.00572 |
| LLaMA 3.3 70B6Meta (via API) | $1.04 | — | $1.04 | 128K | est. | $0.011 |
| Qwen3.7 Max1617Alibaba | $2.50 | $0.250 | $7.50 | 1M | est. | $0.033 |
| Sonar7918Perplexity | $1.00 | — | $1.00 | — | est. | $0.011 |
| Sonar Pro7918Perplexity | $3.00 | — | $15.00 | — | est. | $0.045 |
| Sonar Reasoning Pro918Perplexity | $2.00 | — | $8.00 | — | est. | $0.028 |
| Sonar Deep Research8918Perplexity | $2.00 | — | $8.00 | — | est. | $0.028 |
| Kimi K310Moonshot AI | $3.00 | $0.300 | $15.00 | 1M | est. | $0.045 |
| Kimi K2.7 Code1011Moonshot AI | $0.950 | $0.190 | $4.00 | 262K | est. | $0.013 |
| Kimi K2.610Moonshot AI | $0.950 | $0.160 | $4.00 | 262K | est. | $0.013 |
| MiniMax M31213MiniMax | $0.300 | $0.060 | $1.20 | 1M | est. | $0.00420 |
| MiniMax M2.714MiniMax | $0.300 | $0.060 | $1.20 | 205K | est. | $0.00420 |
| MiniMax M2.5MiniMax | $0.300 | $0.030 | $1.20 | 205K | est. | $0.00420 |
| GLM-5.315Z.ai | $1.40 | $0.280 | $4.40 | 1M | est. | $0.018 |
| GLM-5.215Z.ai | $1.40 | $0.280 | $4.40 | 1M | est. | $0.018 |
| GLM-515Z.ai | $1.00 | $0.200 | $3.20 | 200K | est. | $0.013 |
| GLM-5-Turbo15Z.ai | $1.20 | $0.240 | $4.00 | 200K | est. | $0.016 |
| GLM-4.715Z.ai | $0.600 | $0.120 | $2.20 | 200K | est. | $0.00820 |
| GLM-4.7-FlashX15Z.ai | $0.070 | $0.014 | $0.400 | 200K | est. | $0.00110 |
| GLM-4.5-Air15Z.ai | $0.200 | $0.040 | $1.10 | 128K | est. | $0.00310 |
| GLM-4.5-X1518Z.ai | $2.20 | $0.440 | $8.90 | — | est. | $0.031 |
| Qwen3.7 Plus1617Alibaba | $0.400 | $0.040 | $1.60 | 1M | est. | $0.00560 |
| Qwen3.6 Flash1617Alibaba | $0.250 | $0.025 | $1.50 | 1M | est. | $0.00400 |
| Qwen3.5 Flash17Alibaba | $0.100 | $0.010 | $0.400 | 1M | est. | $0.00140 |
| Qwen3 Coder Plus1617Alibaba | $1.00 | $0.100 | $5.00 | 1M | est. | $0.015 |
| Ningún modelo coincide con esa búsqueda. | ||||||
Todas las tarifas están en dólares estadounidenses por millón de tokens.
Comprobado el 22 de agosto de 2026 contra la página de precios de cada proveedor.
Los proveedores cambian los precios sin avisar, y varios cobran por encima de la tarifa por token: confírmalo en la página del proveedor antes de hacer un presupuesto.
Las tarifas de salida de esta tabla van de $0.400 a $50.00 por millón de tokens: un factor de 125, una palanca mucho mayor que cualquier ajuste de prompt.
11 proveedores, cada uno enlazado a la página de precios de la que se tomaron estas cifras.
En entrada, GLM-4.7-FlashX con $0.070 por millón de tokens; en salida, GLM-4.7-FlashX con $0.400 por millón. Cuál es el más barato para ti depende de la forma de tu tráfico: un prompt de 10.000 tokens con una respuesta de 1000 cuesta $0.00110 en GLM-4.7-FlashX y $0.032 en GPT-5.6 Terra. Introduce arriba tus propios volúmenes y la tabla se reordena en torno a ellos.
Pondera entrada y salida según el uso que hagas realmente del modelo. Los proveedores cobran de tres a cinco veces más por lo que el modelo escribe que por lo que tú envías —GPT-5.6 Terra está a $2.00 de entrada y $12.00 de salida—, así que un resumidor que lee mucho y escribe poco ordena los modelos de forma completamente distinta a un generador de código que hace lo contrario. Introduce arriba los dos volúmenes en lugar de comparar solo las tarifas de entrada, y lee las notas: varios proveedores vuelven a tarificar la petición completa cuando un prompt cruza un umbral de entrada.
Cuando varias peticiones seguidas comparten el mismo principio —un prompt de sistema, un documento, un bloque largo de ejemplos— el proveedor puede servir esa parte desde la caché y cobrarla más barata. La columna de caché es esa tarifa de lectura con acierto, normalmente entre el 10 % y el 20 % de la tarifa de entrada estándar: Claude Sonnet 5 lee la entrada en caché a $0.200 frente a $2.00 estándar. Escribir en la caché no siempre es gratis, y un guion significa que el proveedor no publica ninguna tarifa de caché.
Cada cifra se leyó el 22 de agosto de 2026 de la propia página de precios del proveedor, y cada tarjeta de proveedor enlaza de vuelta a esa página. Nada se consulta en vivo, así que trátalo como una instantánea: los proveedores cambian tarifas sin avisar, y los que trabajan con descuentos promocionales u horas de menor demanda (MiniMax, DeepSeek) son los que más se mueven.
Porque el proveedor no publica ese dato, y adivinarlo sería peor que dejarlo en blanco. Perplexity no publica ventana de contexto para los modelos Sonar, Z.ai no publica una longitud de contexto propia de GLM-4.5-X y la fila de LLaMA alojada de Meta no tiene tarifa de caché. Un guion siempre significa «no publicado», nunca «cero».
Para 11 de las 56 filas: los modelos de OpenAI, porque OpenAI publica su tokenizador y la calculadora carga el vocabulario BPE real (o200k_base) en tu navegador. Todo lo demás va marcado como «est.» y se cuenta con una aproximación de caracteres por token, que se queda a un 10–15 % en prosa pero se desvía más con código, JSON y escrituras no latinas. Los precios son de primera mano en todas las filas; lo que cambia es la fiabilidad del recuento.
No: la tabla muestra solo tarifas por token, y unos cuantos proveedores cobran por encima. Sonar añade entre 5 y 12 dólares por cada 1.000 peticiones por la búsqueda, según el tamaño del contexto; Sonar Deep Research añade cargos por tokens de cita, tokens de razonamiento y búsquedas; y los modelos de pesos abiertos alojados cuestan lo que cobre el proveedor de alojamiento, no lo que anuncie quien creó el modelo. Las notas señalan cada fila en la que la tarifa por token no es la factura completa.
Toma 200.000 tokens de entrada: una novela completa, o unos cientos de páginas de un contrato. Ese único prompt cuesta $0.400 en GPT-5.6 Terra, $0.400 en Claude Sonnet 5, $0.600 en Kimi K3 y $0.020 en Qwen3.5 Flash. A ese tamaño, atiende a las notas de tramo: en Grok 4.6 un prompt de 200K tokens hace que la petición completa se cobre al doble de las tarifas indicadas.
Un precio por millón de tokens no significa nada hasta que sabes cuántos tokens tiene tu texto. La calculadora de tokens cuenta mientras escribes y calcula el coste en todos los modelos; el contador de archivos hace lo mismo con PDF y documentos de Word.