Tarifs de l’API Gemini : 4 modèles, prix par token et par tâche
Les tarifs publics de tous les modèles Google de notre liste, relevés sur la page tarifaire de Google, comparés au coût d’une réponse réussie dans le benchmark AIGROW pour les petites entreprises et à celui de trois tâches courantes avec chaque modèle.
Dollars américains par million de tokens, au tarif standard. Aucun tarif de revendeur.
- Gemini 3.1 Pro (preview)
- $2 / $12
- Gemini 3.8 Flash
- $0.75 / $3.75
- Gemini 3.5 Flash-Lite
- $0.30 / $2.50
- Gemini 3.1 Flash-Lite
- $0.25 / $1.50
Tarif public des tokens d’entrée / de sortie par million.
Les prix des 4 modèles de Google figurant dans notre liste vont de Gemini 3.1 Flash-Lite, à $0.25 en entrée et $1.50 en sortie par million de tokens, à Gemini 3.1 Pro (preview), à $2 en entrée et $12 en sortie. Sur le benchmark AIGROW consacré aux petites entreprises, Gemini 3.1 Pro (preview) a obtenu le meilleur résultat, avec 19 tâches réussies sur 20, à $29.67 pour mille réussites.
Par token et par réussite
Le tarif public par million de tokens, puis le nombre de tâches de bureau réussies par chaque modèle parmi les 20 du benchmark et le coût de 1,000 réponses réussies, essais ratés compris.
| Modèle | Entrée | Sortie | Entrée en cache | Contexte | Tâches réussies | 1,000 réussites |
|---|---|---|---|---|---|---|
| Gemini 3.1 Pro (preview)Modèles phares | $2.00 | $12.00 | $0.20 | 1.05M | 19 sur 20 | $29.67 |
| Gemini 3.8 FlashModèles polyvalents | $0.75 | $3.75 | $0.075 | 1.05M | 18 sur 20 | $7.17 |
| Gemini 3.5 Flash-LitePetits modèles rapides | $0.30 | $2.50 | $0.03 | 1.05M | 7 sur 20 | $2.47 |
| Gemini 3.1 Flash-LitePetits modèles rapides | $0.25 | $1.50 | $0.025 | 1.05M | 9 sur 20 | $1.41 |
Gemma 4 31B a des poids en accès libre, mais aucun tarif public : Google ne vend pas d’API pour ce modèle.
Le coût de trois tâches courantes
1,000 exécutions de chaque tâche au tarif public. Les volumes de tokens sont nos estimations ; les tarifs sont ceux de Google.
| Modèle | 1,000 × réponse au support | 1,000 × résumé de document | 1,000 × tâche confiée à un agent |
|---|---|---|---|
| Gemini 3.1 Pro (preview) | $10.80 | $62.00 | $70.00 |
| Gemini 3.8 Flash | $3.75 | $22.50 | $24.00 |
| Gemini 3.5 Flash-Lite | $1.90 | $10.00 | $12.60 |
| Gemini 3.1 Flash-Lite | $1.35 | $7.75 | $8.75 |
- Réponse au support
- Une requête de 3,000 tokens (le ticket, les échanges précédents et un extrait des règles) et une réponse de 400 tokens.
- Résumé de document
- Un document de 40 pages représentant environ 25,000 tokens en entrée, pour un résumé de 1,000 tokens en sortie.
- Tâche confiée à un agent
- Dix étapes qui lisent au total 80,000 tokens, dont 70,000 tokens de contexte réutilisés d’une étape à l’autre et servis depuis le cache, puis produisent 3,000 tokens.
Les détails tarifaires
Les précisions apportées par les pages tarifaires de Google aux tarifs affichés.
- Gemini 3.1 Pro (preview)
- Modèle en préversion, mais Google ne propose aucun modèle 3.x Pro en disponibilité générale et celui-ci est largement utilisé. Au-delà de 200K tokens par requête : $4 / $18, $0.40 pour l’entrée en cache. Stockage du cache : $4.50 par MTok et par heure. Batch : 50% de réduction. Sortie maximale : 65,536 tokens.
- Gemini 3.8 Flash
- Tarif de lancement jusqu’au 2026-12-31 ; à compter du 2027-01-01, il passera à $1.50 / $7.50, et à $0.15 pour l’entrée en cache. Batch et Flex : 50% de réduction ; Priority : $1.35 / $6.75. Stockage du cache : $0.50 par MTok et par heure (puis $1.00).
- Gemini 3.5 Flash-Lite
- Même tarif pour les entrées texte, image, vidéo et audio. Batch : 50% de réduction. Stockage du cache : $1.00 par MTok et par heure.
- Gemini 3.1 Flash-Lite
- Entrée audio : $0.50 ($0.05 en cache). Batch : 50% de réduction. Stockage du cache : $1.00 par MTok et par heure.
Face-à-face
Les comparatifs mettant un modèle Gemini face à un autre, avec les tarifs des deux et le coût de trois tâches avec chacun.
- GPT-6 Astra face à Gemini 3.1 Pro (preview)
- Claude Fable 5.1 face à Gemini 3.1 Pro (preview)
- Claude Opus 5 face à Gemini 3.1 Pro (preview)
- GPT-5.6 Sol face à Gemini 3.1 Pro (preview)
- Grok 4.7 face à Gemini 3.1 Pro (preview)
- Claude Sonnet 5 face à Gemini 3.8 Flash
- GPT-5.6 Terra face à Gemini 3.8 Flash
- Qwen3.7 Plus face à Gemini 3.8 Flash
- Mistral Medium 3.5 face à Gemini 3.8 Flash
- Grok 4.3 face à Gemini 3.8 Flash
- GPT-5.6 Luna face à Gemini 3.5 Flash-Lite
- GPT-5.6 Luna face à Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 face à Gemini 3.8 Flash
- Gemini 3.5 Flash-Lite face à Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash face à Gemini 3.5 Flash-Lite
- Ministral 3 14B face à Gemma 4 31B
- Gemma 4 31B face à Muse Glimmer 30B
- Qwen3.8 27B face à Gemma 4 31B
Source des tarifs
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW est décompté aux tarifs publics des éditeurs, comme ceux indiqués ci-dessus, et $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts.
Tarifs vérifiés le 22 septembre 2026