Tarifs des modèles

Tarifs des modèles IA

Chaque tarif ci-dessous provient de la page de prix du fournisseur lui-même, vérifiée le 22 août 2026. Comparez les prix d'entrée, de cache et de sortie de 56 modèles issus de 11 fournisseurs, puis saisissez vos propres volumes de tokens pour voir ce que coûterait une seule requête sur chacun d'eux.

  • 56 modèles
  • 11 fournisseurs
  • Vérifié le 22 août 2026
Chiffrer une requête
Préréglages

Cliquez sur un en-tête de colonne pour trier.

Prix d'entrée, d'entrée en cache et de sortie par million de tokens pour 56 modèles IA, avec la fenêtre de contexte, la précision du comptage et le coût estimé par requête
par 1 Mpar 1 Mpar 1 MComptagepar requête
GPT-5.6 Sol1OpenAI$4.00$0.400$20.001Mexact$0.060
GPT-5.6 Terra1OpenAI$2.00$0.200$12.001Mexact$0.032
GPT-5.6 Luna1OpenAI$0.200$0.020$1.201Mexact$0.00320
GPT-5.51OpenAI$5.00$0.500$30.001Mexact$0.080
GPT-5.41OpenAI$2.50$0.250$15.001Mexact$0.040
GPT-5.4 mini1OpenAI$0.750$0.075$4.50400Kexact$0.012
GPT-5.4 nano1OpenAI$0.200$0.020$1.25400Kexact$0.00325
GPT-5.11OpenAI$1.25$0.125$10.00400Kexact$0.022
GPT-4.11OpenAI$2.00$0.500$8.001Mexact$0.028
GPT-4o1OpenAI$2.50$1.25$10.00128Kexact$0.035
GPT-4o Mini1OpenAI$0.150$0.075$0.600128Kexact$0.00210
Claude Fable 52Anthropic$10.00$1.00$50.001Mest.$0.150
Claude Opus 52Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.82Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.72Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.62Anthropic$5.00$0.500$25.001Mest.$0.075
Claude Opus 4.52Anthropic$5.00$0.500$25.00200Kest.$0.075
Claude Sonnet 52Anthropic$2.00$0.200$10.001Mest.$0.030
Claude Sonnet 4.62Anthropic$3.00$0.300$15.001Mest.$0.045
Claude Sonnet 4.52Anthropic$3.00$0.300$15.00200Kest.$0.045
Claude Haiku 4.52Anthropic$1.00$0.100$5.00200Kest.$0.015
Gemini 3.1 Pro3Google$2.00$0.200$12.001Mest.$0.032
Gemini 3.7 FlashGoogle$0.750$0.075$3.751Mest.$0.011
Gemini 3.5 FlashGoogle$1.50$0.150$9.001Mest.$0.024
Gemini 3.5 Flash-LiteGoogle$0.300$0.030$2.501Mest.$0.00550
Gemini 2.5 Pro3Google$1.25$0.125$10.001Mest.$0.022
Grok 4.64xAI$2.00$0.500$6.00500Kest.$0.026
Grok 4.54xAI$2.00$0.300$6.00500Kest.$0.026
Grok 4.34xAI$1.25$0.200$2.501Mest.$0.015
Grok Build 0.14xAI$1.00$0.200$2.00256Kest.$0.012
DeepSeek V4 Pro5DeepSeek$1.32$0.044$3.961Mest.$0.017
DeepSeek V4 Flash5DeepSeek$0.440$0.014$1.321Mest.$0.00572
LLaMA 3.3 70B6Meta (via API)$1.04$1.04128Kest.$0.011
Qwen3.7 Max1617Alibaba$2.50$0.250$7.501Mest.$0.033
Sonar7918Perplexity$1.00$1.00est.$0.011
Sonar Pro7918Perplexity$3.00$15.00est.$0.045
Sonar Reasoning Pro918Perplexity$2.00$8.00est.$0.028
Sonar Deep Research8918Perplexity$2.00$8.00est.$0.028
Kimi K310Moonshot AI$3.00$0.300$15.001Mest.$0.045
Kimi K2.7 Code1011Moonshot AI$0.950$0.190$4.00262Kest.$0.013
Kimi K2.610Moonshot AI$0.950$0.160$4.00262Kest.$0.013
MiniMax M31213MiniMax$0.300$0.060$1.201Mest.$0.00420
MiniMax M2.714MiniMax$0.300$0.060$1.20205Kest.$0.00420
MiniMax M2.5MiniMax$0.300$0.030$1.20205Kest.$0.00420
GLM-5.315Z.ai$1.40$0.280$4.401Mest.$0.018
GLM-5.215Z.ai$1.40$0.280$4.401Mest.$0.018
GLM-515Z.ai$1.00$0.200$3.20200Kest.$0.013
GLM-5-Turbo15Z.ai$1.20$0.240$4.00200Kest.$0.016
GLM-4.715Z.ai$0.600$0.120$2.20200Kest.$0.00820
GLM-4.7-FlashX15Z.ai$0.070$0.014$0.400200Kest.$0.00110
GLM-4.5-Air15Z.ai$0.200$0.040$1.10128Kest.$0.00310
GLM-4.5-X1518Z.ai$2.20$0.440$8.90est.$0.031
Qwen3.7 Plus1617Alibaba$0.400$0.040$1.601Mest.$0.00560
Qwen3.6 Flash1617Alibaba$0.250$0.025$1.501Mest.$0.00400
Qwen3.5 Flash17Alibaba$0.100$0.010$0.4001Mest.$0.00140
Qwen3 Coder Plus1617Alibaba$1.00$0.100$5.001Mest.$0.015

Notes

  1. OpenAI facture les prompts au-delà de 272K tokens d'entrée à un tarif supérieur ; le chiffre affiché est celui du palier standard.
  2. La colonne cache correspond au tarif de lecture d'Anthropic en cas de succès du cache. Écrire dans le cache coûte plus cher qu'une entrée ordinaire.
  3. Google facture les prompts au-delà de 200K tokens d'entrée à environ le double de ces tarifs.
  4. À partir de 200K tokens de prompt, xAI facture la requête entière au double de ces tarifs d'entrée, de cache et de sortie.
  5. Tarifs standard (heures pleines). Entre 01h00–04h00 et 06h00–10h00 UTC, DeepSeek facture la moitié.
  6. Meta publie des poids plutôt qu'une API : il s'agit donc d'un tarif serverless hébergé (Together AI) et non d'un prix de première main.
  7. En plus des tarifs par token, Perplexity facture la recherche à la requête : 5, 8 ou 12 dollars pour 1 000 requêtes selon l'ampleur du contexte de recherche.
  8. Deep Research facture en outre 2 dollars par million de tokens de citation, 3 dollars par million de tokens de raisonnement et 5 dollars pour 1 000 recherches.
  9. Les chat completions Sonar sont passées à l'Agent API de Perplexity ; les modèles Sonar sont pris en charge jusqu'au 27 septembre 2026.
  10. Moonshot annonce ces tarifs hors taxes.
  11. La variante « -highspeed » facture entrée et sortie au double de ces tarifs.
  12. Palier de service standard jusqu'à 512K tokens d'entrée. Au-delà, la requête entière est facturée au double, et le palier priority coûte environ 1,5 fois plus.
  13. MiniMax présente ce tarif comme une remise permanente de 50 % : le prix catalogue est le double.
  14. La variante « -highspeed » facture le double de ces tarifs.
  15. Z.ai facture les lectures en cache au cinquième du tarif d'entrée.
  16. Alibaba applique des paliers selon la taille de la requête : franchir un seuil d'entrée (256K sur la plupart des modèles, 32K sur Qwen3 Coder Plus) retarife la requête entière — jusqu'à 1,20 dollar en entrée / 4,80 dollars en sortie sur Qwen3.7 Plus, et 6,00 / 60,00 dollars sur Qwen3 Coder Plus.
  17. Grille tarifaire de Singapour (international) d'Alibaba. La région de Pékin est facturée séparément, à des tarifs différents.
  18. Le fournisseur ne publie pas de fenêtre de contexte pour ce modèle : la colonne affiche donc « — ».

Tous les tarifs sont en dollars américains par million de tokens.

Vérifié le 22 août 2026 sur la page de prix de chaque fournisseur.

Les fournisseurs changent leurs prix sans préavis, et plusieurs facturent au-delà du tarif par token — vérifiez sur la page du fournisseur avant d'établir un budget.

Les moins chers en premier

Meilleur rapport par million de tokens

Les tarifs de sortie de ce tableau vont de $0.400 à $50.00 par million de tokens — un facteur 125, soit un levier bien plus puissant que n'importe quel réglage de prompt.

Entrée la moins chère

  1. 1GLM-4.7-FlashXZ.ai$0.070par million de tokens
  2. 2Qwen3.5 FlashAlibaba$0.100par million de tokens
  3. 3GPT-4o MiniOpenAI$0.150par million de tokens
  4. 4GLM-4.5-AirZ.ai$0.200par million de tokens
  5. 5GPT-5.6 LunaOpenAI$0.200par million de tokens

Sortie la moins chère

  1. 1GLM-4.7-FlashXZ.ai$0.400par million de tokens
  2. 2Qwen3.5 FlashAlibaba$0.400par million de tokens
  3. 3GPT-4o MiniOpenAI$0.600par million de tokens
  4. 4SonarPerplexity$1.00par million de tokens
  5. 5LLaMA 3.3 70BMeta (via API)$1.04par million de tokens
Par fournisseur

Fournisseurs présents dans ce tableau

11 fournisseurs, chacun renvoyant à la page de prix d'où viennent ces chiffres.

FAQ

Questions fréquentes

Quel modèle IA est le moins cher ?

En entrée, GLM-4.7-FlashX à $0.070 par million de tokens ; en sortie, GLM-4.7-FlashX à $0.400 par million. Lequel est le moins cher pour vous dépend de la forme de votre trafic : un prompt de 10 000 tokens avec une réponse de 1 000 tokens coûte $0.00110 sur GLM-4.7-FlashX et $0.032 sur GPT-5.6 Terra. Renseignez vos propres volumes ci-dessus et le tableau se réorganise autour d'eux.

Comment comparer honnêtement les tarifs des modèles ?

Pondérez l'entrée et la sortie selon votre usage réel. Les fournisseurs facturent trois à cinq fois plus ce que le modèle écrit que ce que vous envoyez — GPT-5.6 Terra est à $2.00 en entrée et $12.00 en sortie — de sorte qu'un résumeur qui lit beaucoup et écrit peu classe les modèles tout autrement qu'un générateur de code qui fait l'inverse. Saisissez les deux volumes ci-dessus plutôt que de comparer les seuls tarifs d'entrée, et lisez les notes : plusieurs fournisseurs retarifent la requête entière dès qu'un prompt franchit un seuil d'entrée.

Qu'est-ce que la tarification de l'entrée en cache ?

Quand des requêtes successives partagent le même début — un prompt système, un document, un long bloc d'exemples — le fournisseur peut servir cette partie depuis son cache et la facturer moins cher. La colonne cache correspond à ce tarif de lecture en cas de succès, généralement 10 à 20 % du tarif d'entrée standard : Claude Sonnet 5 lit l'entrée en cache à $0.200 contre $2.00 en standard. Écrire dans le cache n'est pas toujours gratuit, et un tiret signifie que le fournisseur ne publie aucun tarif de cache.

À quel point ces tarifs sont-ils à jour ?

Chaque chiffre a été relevé le 22 août 2026 sur la page de prix du fournisseur, et chaque fiche fournisseur renvoie à la page d'origine. Rien n'est récupéré en direct : considérez ce tableau comme un instantané. Les fournisseurs changent leurs tarifs sans préavis, et ceux qui pratiquent des remises promotionnelles ou des heures creuses (MiniMax, DeepSeek) bougent le plus souvent.

Pourquoi certaines cases affichent-elles un tiret ?

Parce que le fournisseur ne publie pas cette valeur, et que deviner serait pire que de laisser la case vide. Perplexity ne publie aucune fenêtre de contexte pour les modèles Sonar, Z.ai aucune longueur de contexte propre à GLM-4.5-X, et la ligne LLaMA hébergée de Meta n'a pas de tarif de cache. Un tiret signifie toujours « non publié », jamais « zéro ».

Pour quels modèles le site compte-t-il les tokens exactement ?

Pour 11 des 56 lignes — les modèles OpenAI, parce qu'OpenAI publie son tokenizer et que le calculateur charge le véritable vocabulaire BPE (o200k_base) dans votre navigateur. Tout le reste est marqué « est. » et compté par approximation en caractères par token : l'écart reste d'environ 10 à 15 % sur de la prose, mais se creuse sur le code, le JSON et les écritures non latines. Les prix, eux, sont de première main pour chaque ligne ; seule la fiabilité du comptage varie.

Ces tarifs incluent-ils les frais de recherche et de requête ?

Non — le tableau ne montre que les tarifs par token, et quelques fournisseurs facturent en plus. Sonar ajoute 5 à 12 dollars pour 1 000 requêtes au titre de la recherche selon l'ampleur du contexte, Sonar Deep Research ajoute des frais de tokens de citation, de tokens de raisonnement et de recherches, et les modèles à poids ouverts hébergés coûtent ce que facture l'hébergeur, non ce qu'annonce le concepteur. Les notes signalent chaque ligne où le tarif par token n'est pas la facture entière.

Combien coûte réellement un prompt long ?

Prenez 200 000 tokens d'entrée — un roman entier, ou quelques centaines de pages de contrat. Ce seul prompt coûte $0.400 sur GPT-5.6 Terra, $0.400 sur Claude Sonnet 5, $0.600 sur Kimi K3 et $0.020 sur Qwen3.5 Flash. À cette taille, surveillez les notes de palier : sur Grok 4.6, un prompt de 200K tokens fait facturer la requête entière au double des tarifs affichés.

Comptez d'abord les tokens

Un prix par million de tokens ne veut rien dire tant que vous ne savez pas combien de tokens contient votre texte. Le calculateur de tokens compte à la frappe et chiffre le résultat sur l'ensemble des modèles ; le compteur de fichiers fait de même pour les PDF et les documents Word.