Combien coûtent 37 modèles d’IA, selon les tarifs publiés par leurs éditeurs
Le prix catalogue de chaque modèle qu’une petite entreprise pourrait envisager, issu de 11 éditeurs, et le coût de trois tâches courantes pour chacun : une réponse au support client, un résumé de document et une tâche d’agent.
Prix en dollars américains par million de tokens, au tarif standard. Aucun prix de revendeur.
- Modèles
- 37
- Éditeurs
- 11
- Poids ouverts
- 15
- Aucun tarif public
- 4
3,000 tokens en entrée et 400 en sortie par réponse, au tarif public.
Nous avons relevé les prix catalogue de 37 modèles d’IA auprès de 11 éditeurs, sur leurs propres pages tarifaires, le 22 septembre 2026. Pour 1,000 réponses au support client, le moins cher, Qwen3.8 Flash, coûte $0.64, et le plus cher, GPT-6 Astra, $50.00 : un écart de 78 fois pour la même tâche.
Modèles phares
Le modèle le plus performant de chaque laboratoire, celui qu’il destine aux tâches les plus difficiles.
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| MiniMax M3MiniMax · poids ouverts | $0.30 | $1.20 | 1M | $1.38 |
| Muse Spark 1.3Meta | $1.25 | $4.25 | 1.05M | $5.45 |
| DeepSeek V4 ProDeepSeek · poids ouverts | $1.32 | $3.96 | 1M | $5.54 |
| GLM-5.3Z.ai · poids ouverts | $1.40 | $4.40 | 1M | $5.96 |
| Mistral Medium 3.5Mistral · poids ouverts | $1.50 | $7.50 | 256K | $7.50 |
| Grok 4.7xAI | $2.00 | $6.00 | 500K | $8.40 |
| Qwen3.8 MaxAlibaba (Qwen) | $2.00 | $6.00 | 1M | $8.40 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Kimi K3Moonshot AI · poids ouverts | $3.00 | $15.00 | 1.05M | $15.00 |
| GPT-5.6 SolOpenAI | $4.00 | $20.00 | 1.05M | $20.00 |
| Claude Opus 5Anthropic | $5.00 | $25.00 | 1M | $25.00 |
| GPT-5.5OpenAI | $5.00 | $30.00 | 1.05M | $27.00 |
| Claude Fable 5.1Anthropic | $10.00 | $50.00 | 1M | $50.00 |
| GPT-6 AstraOpenAI | $10.00 | $50.00 | 1.05M | $50.00 |
Modèles polyvalents
Le milieu de gamme de chaque laboratoire : le modèle utilisé au quotidien par la plupart des produits.
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| Qwen3.7 PlusAlibaba (Qwen) | $0.40 | $1.60 | 1M | $1.84 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Kimi K2.6Moonshot AI · poids ouverts | $0.95 | $4.00 | 262K | $4.45 |
| Claude Sonnet 5Anthropic | $2.00 | $10.00 | 1M | $10.00 |
| GPT-5.6 TerraOpenAI | $2.00 | $12.00 | 1.05M | $10.80 |
| Claude Sonnet 4.6Anthropic | $3.00 | $15.00 | 1M | $15.00 |
| gpt-oss-120bOpenAI · poids ouverts | Aucun tarif public | · | 131K | · |
| Llama 4 MaverickMeta · poids ouverts | Aucun tarif public | · | 1M | · |
Petits modèles rapides
Le modèle le moins cher et le plus rapide de chaque laboratoire, adapté aux gros volumes et aux tâches simples.
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| Qwen3.8 FlashAlibaba (Qwen) | $0.15 | $0.47 | 1M | $0.64 |
| GLM-5.3-FlashZ.ai · poids ouverts | $0.15 | $0.50 | 1M | $0.65 |
| Ministral 3 14BMistral · poids ouverts | $0.20 | $0.20 | 256K | $0.68 |
| Mistral Small 4Mistral · poids ouverts | $0.15 | $0.60 | 256K | $0.69 |
| GPT-5.6 LunaOpenAI | $0.20 | $1.20 | 1.05M | $1.08 |
| GPT-5.4 nanoOpenAI | $0.20 | $1.25 | 400K | $1.10 |
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| DeepSeek V4.1 FlashDeepSeek · poids ouverts | $0.30 | $1.20 | 1M | $1.38 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Qwen3.8 27BAlibaba (Qwen) · poids ouverts | $0.50 | $3.00 | 1M | $2.70 |
| GPT-5.4 miniOpenAI | $0.75 | $4.50 | 400K | $4.05 |
| Grok 4.3xAI | $1.25 | $2.50 | 1M | $4.75 |
| Claude Haiku 4.5Anthropic | $1.00 | $5.00 | 200K | $5.00 |
| Gemma 4 31BGoogle · poids ouverts | Aucun tarif public | · | 256K | · |
| Muse Glimmer 30BMeta · poids ouverts | Aucun tarif public | · | 128K | · |
Les trois tâches utilisées pour calculer chaque coût
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Chaque page de modèle calcule le coût des trois tâches.
- Réponse au support
- Une requête de 3,000 tokens (le ticket, les échanges précédents et un extrait des règles) et une réponse de 400 tokens. 3,000 en entrée, 400 en sortie.
- Résumé de document
- Un document de 40 pages représentant environ 25,000 tokens en entrée, pour un résumé de 1,000 tokens en sortie. 25,000 en entrée, 1,000 en sortie.
- Tâche confiée à un agent
- Dix étapes qui lisent au total 80,000 tokens, dont 70,000 tokens de contexte réutilisés d’une étape à l’autre et servis depuis le cache, puis produisent 3,000 tokens. 80,000 en entrée (dont 70,000 en cache), 3,000 en sortie.
Les catégories suivent la gamme propre à chaque éditeur, et non une tranche de prix. Le modèle phare d’un laboratoire peut donc coûter moins cher que le modèle polyvalent d’un autre. 4 modèles à poids ouverts n’ont pas de prix catalogue, car leurs éditeurs ne proposent pas d’API pour eux ; leur coût dépend de l’hébergeur.
Face-à-face
Les 52 comparatifs que les internautes recherchent, avec les deux prix et le coût des trois tâches pour chaque modèle.
- GPT-6 Astra face à Claude Fable 5.1
- GPT-6 Astra face à Gemini 3.1 Pro (preview)
- Claude Fable 5.1 face à Gemini 3.1 Pro (preview)
- GPT-6 Astra face à GPT-5.6 Sol
- Claude Fable 5.1 face à Claude Opus 5
- GPT-5.5 face à GPT-5.6 Sol
- Claude Opus 5 face à GPT-5.6 Sol
- Claude Opus 5 face à Gemini 3.1 Pro (preview)
- GPT-5.6 Sol face à Gemini 3.1 Pro (preview)
- Grok 4.7 face à GPT-5.6 Sol
- Grok 4.7 face à Claude Opus 5
- Grok 4.7 face à Gemini 3.1 Pro (preview)
- DeepSeek V4 Pro face à Claude Opus 5
- DeepSeek V4 Pro face à GPT-5.6 Sol
- Kimi K3 face à Claude Opus 5
- Qwen3.8 Max face à DeepSeek V4 Pro
- GLM-5.3 face à DeepSeek V4 Pro
- GLM-5.3 face à Kimi K3
- MiniMax M3 face à DeepSeek V4 Pro
- Muse Spark 1.3 face à GPT-5.6 Sol
- Muse Spark 1.3 face à Grok 4.7
- Mistral Medium 3.5 face à Claude Sonnet 5
- Claude Sonnet 5 face à GPT-5.6 Terra
- Claude Sonnet 5 face à Gemini 3.8 Flash
- GPT-5.6 Terra face à Gemini 3.8 Flash
- Claude Sonnet 5 face à Claude Sonnet 4.6
- Claude Sonnet 5 face à Claude Opus 5
- GPT-5.6 Sol face à GPT-5.6 Terra
- Qwen3.7 Plus face à Gemini 3.8 Flash
- Kimi K2.6 face à GPT-5.6 Terra
- Mistral Medium 3.5 face à Gemini 3.8 Flash
- Grok 4.3 face à Gemini 3.8 Flash
- Llama 4 Maverick face à gpt-oss-120b
- gpt-oss-120b face à DeepSeek V4.1 Flash
- GPT-5.6 Luna face à Gemini 3.5 Flash-Lite
- GPT-5.6 Luna face à Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 face à GPT-5.6 Luna
- Claude Haiku 4.5 face à Gemini 3.8 Flash
- Claude Haiku 4.5 face à GPT-5.4 mini
- GPT-5.4 mini face à GPT-5.6 Luna
- GPT-5.4 nano face à GPT-5.6 Luna
- Gemini 3.5 Flash-Lite face à Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash face à GPT-5.6 Luna
- DeepSeek V4.1 Flash face à Gemini 3.5 Flash-Lite
- Qwen3.8 Flash face à DeepSeek V4.1 Flash
- GLM-5.3-Flash face à Qwen3.8 Flash
- Mistral Small 4 face à GPT-5.6 Luna
- Grok 4.3 face à DeepSeek V4.1 Flash
- Ministral 3 14B face à Gemma 4 31B
- Gemma 4 31B face à Muse Glimmer 30B
- Muse Glimmer 30B face à Qwen3.8 27B
- Qwen3.8 27B face à Gemma 4 31B
Prix par éditeur
Une page par laboratoire : le coût de ses modèles par token, par tâche courante et par réponse réussie au benchmark.
Source des tarifs
Chaque prix provient de la page tarifaire ou de la documentation du modèle publiée par son éditeur. Voici ces sources.
- Mistral
- docs.mistral.ai/models/mistral-medium-3-5-26-04 · docs.mistral.ai/models/mistral-small-4-0-26-03 · docs.mistral.ai/models/ministral-3-14b-25-12
- Alibaba (Qwen)
- alibabacloud.com/help/en/model-studio/model-pricing
- Moonshot AI
- platform.kimi.ai/docs/pricing/chat
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez un quart de ces prix
Le crédit API AIGROW est décompté aux tarifs publics des éditeurs, comme ceux indiqués ci-dessus, et $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts.
Tarifs vérifiés le 22 septembre 2026