Precios de modelos

Precios de modelos de IA

Cada tarifa de esta página se ha leído de la propia página de precios del proveedor el 22 de agosto de 2026. Compara los precios de entrada, caché y salida de 56 modelos de 11 proveedores y luego introduce tus volúmenes de tokens para ver cuánto costaría una sola petición en cada uno.

  • 56 modelos
  • 11 proveedores
  • Comprobado el 22 de agosto de 2026
Calcular una petición
Valores rápidos

Haz clic en una cabecera de columna para ordenar.

Precios de entrada, entrada en caché y salida por millón de tokens de 56 modelos de IA, con su ventana de contexto, la precisión del recuento de tokens y el coste estimado por petición
por 1 Mpor 1 Mpor 1 MRecuentopor petición
GPT-5.6 Sol1OpenAI$4.00$0.400$20.001Mexacto$0.060
GPT-5.6 Terra1OpenAI$2.00$0.200$12.001Mexacto$0.032
GPT-5.6 Luna1OpenAI$0.200$0.020$1.201Mexacto$0.00320
GPT-5.51OpenAI$5.00$0.500$30.001Mexacto$0.080
GPT-5.41OpenAI$2.50$0.250$15.001Mexacto$0.040
GPT-5.4 mini1OpenAI$0.750$0.075$4.50400Kexacto$0.012
GPT-5.4 nano1OpenAI$0.200$0.020$1.25400Kexacto$0.00325
GPT-5.11OpenAI$1.25$0.125$10.00400Kexacto$0.022
GPT-4.11OpenAI$2.00$0.500$8.001Mexacto$0.028
GPT-4o1OpenAI$2.50$1.25$10.00128Kexacto$0.035
GPT-4o Mini1OpenAI$0.150$0.075$0.600128Kexacto$0.00210
Claude Fable 52Anthropic$10.00$1.00$50.001Mest.$0.150
Claude Opus 52Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.82Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.72Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.62Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.52Anthropic$5.00$0.500$25.00200Kest.$0.075
Claude Sonnet 52Anthropic$2.00$0.200$10.001Mest.$0.030
Claude Sonnet 4.62Anthropic$3.00$0.300$15.001Mest.$0.045
Claude Sonnet 4.52Anthropic$3.00$0.300$15.00200Kest.$0.045
Claude Haiku 4.52Anthropic$1.00$0.100$5.00200Kest.$0.015
Gemini 3.1 Pro3Google$2.00$0.200$12.001Mest.$0.032
Gemini 3.7 FlashGoogle$0.750$0.075$3.751Mest.$0.011
Gemini 3.5 FlashGoogle$1.50$0.150$9.001Mest.$0.024
Gemini 3.5 Flash-LiteGoogle$0.300$0.030$2.501Mest.$0.00550
Gemini 2.5 Pro3Google$1.25$0.125$10.001Mest.$0.022
Grok 4.64xAI$2.00$0.500$6.00500Kest.$0.026
Grok 4.54xAI$2.00$0.300$6.00500Kest.$0.026
Grok 4.34xAI$1.25$0.200$2.501Mest.$0.015
Grok Build 0.14xAI$1.00$0.200$2.00256Kest.$0.012
DeepSeek V4 Pro5DeepSeek$1.32$0.044$3.961Mest.$0.017
DeepSeek V4 Flash5DeepSeek$0.440$0.014$1.321Mest.$0.00572
LLaMA 3.3 70B6Meta (via API)$1.04$1.04128Kest.$0.011
Qwen3.7 Max1617Alibaba$2.50$0.250$7.501Mest.$0.033
Sonar7918Perplexity$1.00$1.00est.$0.011
Sonar Pro7918Perplexity$3.00$15.00est.$0.045
Sonar Reasoning Pro918Perplexity$2.00$8.00est.$0.028
Sonar Deep Research8918Perplexity$2.00$8.00est.$0.028
Kimi K310Moonshot AI$3.00$0.300$15.001Mest.$0.045
Kimi K2.7 Code1011Moonshot AI$0.950$0.190$4.00262Kest.$0.013
Kimi K2.610Moonshot AI$0.950$0.160$4.00262Kest.$0.013
MiniMax M31213MiniMax$0.300$0.060$1.201Mest.$0.00420
MiniMax M2.714MiniMax$0.300$0.060$1.20205Kest.$0.00420
MiniMax M2.5MiniMax$0.300$0.030$1.20205Kest.$0.00420
GLM-5.315Z.ai$1.40$0.280$4.401Mest.$0.018
GLM-5.215Z.ai$1.40$0.280$4.401Mest.$0.018
GLM-515Z.ai$1.00$0.200$3.20200Kest.$0.013
GLM-5-Turbo15Z.ai$1.20$0.240$4.00200Kest.$0.016
GLM-4.715Z.ai$0.600$0.120$2.20200Kest.$0.00820
GLM-4.7-FlashX15Z.ai$0.070$0.014$0.400200Kest.$0.00110
GLM-4.5-Air15Z.ai$0.200$0.040$1.10128Kest.$0.00310
GLM-4.5-X1518Z.ai$2.20$0.440$8.90est.$0.031
Qwen3.7 Plus1617Alibaba$0.400$0.040$1.601Mest.$0.00560
Qwen3.6 Flash1617Alibaba$0.250$0.025$1.501Mest.$0.00400
Qwen3.5 Flash17Alibaba$0.100$0.010$0.4001Mest.$0.00140
Qwen3 Coder Plus1617Alibaba$1.00$0.100$5.001Mest.$0.015

Notas

  1. OpenAI cobra los prompts de más de 272K tokens de entrada a una tarifa superior; la cifra mostrada es la del nivel estándar.
  2. La columna de caché es la tarifa de lectura de Anthropic cuando hay acierto de caché. Escribir en la caché cuesta más que la entrada normal.
  3. Google cobra los prompts de más de 200K tokens de entrada a aproximadamente el doble de estas tarifas.
  4. A partir de 200K tokens de prompt, xAI cobra la petición completa al doble de estas tarifas de entrada, caché y salida.
  5. Tarifas estándar (hora punta). Entre las 01:00–04:00 y las 06:00–10:00 UTC, DeepSeek cobra la mitad.
  6. Meta publica pesos en lugar de una API, así que esta es una tarifa serverless alojada (Together AI) y no un precio de primera mano.
  7. Además de las tarifas por token, Perplexity cobra la búsqueda por petición: 5, 8 o 12 dólares por cada 1.000 peticiones según el tamaño del contexto de búsqueda.
  8. Deep Research cobra también 2 dólares por millón de tokens de cita, 3 dólares por millón de tokens de razonamiento y 5 dólares por cada 1.000 búsquedas.
  9. Los chat completions de Sonar han pasado a la Agent API de Perplexity; los modelos Sonar tienen soporte hasta el 27 de septiembre de 2026.
  10. Moonshot indica estas tarifas sin impuestos.
  11. La variante «-highspeed» cobra entrada y salida al doble de estas tarifas.
  12. Nivel de servicio estándar hasta 512K tokens de entrada. Por encima, la petición completa se cobra al doble, y el nivel priority cuesta alrededor de 1,5 veces más.
  13. MiniMax presenta esta tarifa como un descuento permanente del 50 %: el precio de catálogo es el doble.
  14. La variante «-highspeed» cobra el doble de estas tarifas.
  15. Z.ai cobra las lecturas con acierto de caché a la quinta parte de la tarifa de entrada.
  16. Alibaba aplica tramos según el tamaño de la petición: cruzar un umbral de entrada (256K en la mayoría de modelos, 32K en Qwen3 Coder Plus) vuelve a tarificar la petición completa, hasta 1,20 dólares de entrada / 4,80 de salida en Qwen3.7 Plus y 6,00 / 60,00 dólares en Qwen3 Coder Plus.
  17. Lista de precios de Singapur (internacional) de Alibaba. La región de Pekín se factura por separado y con tarifas distintas.
  18. El proveedor no publica ventana de contexto para este modelo, así que la columna muestra «—».

Todas las tarifas están en dólares estadounidenses por millón de tokens.

Comprobado el 22 de agosto de 2026 contra la página de precios de cada proveedor.

Los proveedores cambian los precios sin avisar, y varios cobran por encima de la tarifa por token: confírmalo en la página del proveedor antes de hacer un presupuesto.

Los más baratos primero

Mejor relación por millón de tokens

Las tarifas de salida de esta tabla van de $0.400 a $50.00 por millón de tokens: un factor de 125, una palanca mucho mayor que cualquier ajuste de prompt.

Entrada más barata

  1. 1GLM-4.7-FlashXZ.ai$0.070por millón de tokens
  2. 2Qwen3.5 FlashAlibaba$0.100por millón de tokens
  3. 3GPT-4o MiniOpenAI$0.150por millón de tokens
  4. 4GLM-4.5-AirZ.ai$0.200por millón de tokens
  5. 5GPT-5.6 LunaOpenAI$0.200por millón de tokens

Salida más barata

  1. 1GLM-4.7-FlashXZ.ai$0.400por millón de tokens
  2. 2Qwen3.5 FlashAlibaba$0.400por millón de tokens
  3. 3GPT-4o MiniOpenAI$0.600por millón de tokens
  4. 4SonarPerplexity$1.00por millón de tokens
  5. 5LLaMA 3.3 70BMeta (via API)$1.04por millón de tokens
Por proveedor

Proveedores de esta tabla

11 proveedores, cada uno enlazado a la página de precios de la que se tomaron estas cifras.

Preguntas frecuentes

Preguntas frecuentes

¿Qué modelo de IA es el más barato?

En entrada, GLM-4.7-FlashX con $0.070 por millón de tokens; en salida, GLM-4.7-FlashX con $0.400 por millón. Cuál es el más barato para ti depende de la forma de tu tráfico: un prompt de 10.000 tokens con una respuesta de 1000 cuesta $0.00110 en GLM-4.7-FlashX y $0.032 en GPT-5.6 Terra. Introduce arriba tus propios volúmenes y la tabla se reordena en torno a ellos.

¿Cómo comparo precios de modelos de forma justa?

Pondera entrada y salida según el uso que hagas realmente del modelo. Los proveedores cobran de tres a cinco veces más por lo que el modelo escribe que por lo que tú envías —GPT-5.6 Terra está a $2.00 de entrada y $12.00 de salida—, así que un resumidor que lee mucho y escribe poco ordena los modelos de forma completamente distinta a un generador de código que hace lo contrario. Introduce arriba los dos volúmenes en lugar de comparar solo las tarifas de entrada, y lee las notas: varios proveedores vuelven a tarificar la petición completa cuando un prompt cruza un umbral de entrada.

¿Qué es el precio de entrada en caché?

Cuando varias peticiones seguidas comparten el mismo principio —un prompt de sistema, un documento, un bloque largo de ejemplos— el proveedor puede servir esa parte desde la caché y cobrarla más barata. La columna de caché es esa tarifa de lectura con acierto, normalmente entre el 10 % y el 20 % de la tarifa de entrada estándar: Claude Sonnet 5 lee la entrada en caché a $0.200 frente a $2.00 estándar. Escribir en la caché no siempre es gratis, y un guion significa que el proveedor no publica ninguna tarifa de caché.

¿Qué tan actualizados están estos precios?

Cada cifra se leyó el 22 de agosto de 2026 de la propia página de precios del proveedor, y cada tarjeta de proveedor enlaza de vuelta a esa página. Nada se consulta en vivo, así que trátalo como una instantánea: los proveedores cambian tarifas sin avisar, y los que trabajan con descuentos promocionales u horas de menor demanda (MiniMax, DeepSeek) son los que más se mueven.

¿Por qué algunas celdas muestran un guion?

Porque el proveedor no publica ese dato, y adivinarlo sería peor que dejarlo en blanco. Perplexity no publica ventana de contexto para los modelos Sonar, Z.ai no publica una longitud de contexto propia de GLM-4.5-X y la fila de LLaMA alojada de Meta no tiene tarifa de caché. Un guion siempre significa «no publicado», nunca «cero».

¿Para qué modelos puede este sitio contar tokens de forma exacta?

Para 11 de las 56 filas: los modelos de OpenAI, porque OpenAI publica su tokenizador y la calculadora carga el vocabulario BPE real (o200k_base) en tu navegador. Todo lo demás va marcado como «est.» y se cuenta con una aproximación de caracteres por token, que se queda a un 10–15 % en prosa pero se desvía más con código, JSON y escrituras no latinas. Los precios son de primera mano en todas las filas; lo que cambia es la fiabilidad del recuento.

¿Incluyen estos precios las tarifas de búsqueda y por petición?

No: la tabla muestra solo tarifas por token, y unos cuantos proveedores cobran por encima. Sonar añade entre 5 y 12 dólares por cada 1.000 peticiones por la búsqueda, según el tamaño del contexto; Sonar Deep Research añade cargos por tokens de cita, tokens de razonamiento y búsquedas; y los modelos de pesos abiertos alojados cuestan lo que cobre el proveedor de alojamiento, no lo que anuncie quien creó el modelo. Las notas señalan cada fila en la que la tarifa por token no es la factura completa.

¿Cuánto cuesta de verdad un prompt largo?

Toma 200.000 tokens de entrada: una novela completa, o unos cientos de páginas de un contrato. Ese único prompt cuesta $0.400 en GPT-5.6 Terra, $0.400 en Claude Sonnet 5, $0.600 en Kimi K3 y $0.020 en Qwen3.5 Flash. A ese tamaño, atiende a las notas de tramo: en Grok 4.6 un prompt de 200K tokens hace que la petición completa se cobre al doble de las tarifas indicadas.

Cuenta primero los tokens

Un precio por millón de tokens no significa nada hasta que sabes cuántos tokens tiene tu texto. La calculadora de tokens cuenta mientras escribes y calcula el coste en todos los modelos; el contador de archivos hace lo mismo con PDF y documentos de Word.