Gemini 3.1 Flash-Lite : combien coûte son utilisation
Le prix affiché par Google pour Gemini 3.1 Flash-Lite, le coût d’une réponse au support client, d’un résumé de document et d’une tâche d’agent, ainsi que son rang parmi 37 modèles.
Dollars américains par million de tokens, tarif standard, tranche de contexte la plus courte.
- 1,000 réponses au support
- $1.35
- Entrée en cache
- $0.025
- Fenêtre de contexte
- 1 048 576 tokens
- Date de sortie
- 7 mai 2026
- Poids
- Clôturées
D’après les pages de Google, le 22 septembre 2026.
Sur l’API de Google, Gemini 3.1 Flash-Lite coûte $0.25 par million de tokens d’entrée et $1.50 par million de tokens de sortie, et $0.025 pour les tokens d’entrée mis en cache. À ces tarifs, 1,000 réponses au support client coûtent $1.35, ce qui le place le 7e parmi les moins chers sur 33 modèles tarifés dans notre liste.
Le coût d’une tâche
Trois tâches, 1,000 exécutions de chacune, au prix catalogue ci-dessus, avec le rang de Gemini 3.1 Flash-Lite pour chacune parmi les 33 modèles ayant un prix catalogue.
| Tâche | 1,000 exécutions | Parmi 33 |
|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $1.35 | 7e parmi les moins chers |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $7.75 | 7e parmi les moins chers |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $8.75 | 5e parmi les moins chers |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent de Google. Chacune des trois tâches reste sous 200,000 tokens par requête, en deçà de toutes les majorations pour contexte long de la liste.
Gemini 3.1 Flash-Lite face aux tâches réelles d’une petite entreprise
Ce que le benchmark AIGROW a mesuré en soumettant 20 tâches de bureau à Gemini 3.1 Flash-Lite, chacune évaluée comme réussie ou échouée selon des critères fixes.
- Taux de réussite
- 45% des 20 exécutions ont réussi (intervalle à 95 % : 26 à 66 %), 28e sur 36 modèles.
- Coût pour 1 000 tâches réussies
- $1.41, exécutions échouées comprises.
- Temps de réponse
- Médiane de 1.7 s, 3.2 s au 90e percentile.
- Meilleur et moins bon résultat
- Tri des e-mails (100% de réussite) et Réponses aux avis (0%).
Les détails tarifaires
Ce que le tarif de base ci-dessus ne comprend pas, d’après les pages de l’éditeur : majorations, remises, promotions et tarifs de cache.
Entrée audio : $0.50 ($0.05 en cache). Batch : 50% de réduction. Stockage du cache : $1.00 par MTok et par heure.
Gemini 3.1 Flash-Lite face aux modèles auxquels il est comparé
Chaque comparatif présente les deux prix catalogue côte à côte et calcule le coût des trois mêmes tâches pour chaque modèle.
- face à GPT-5.6 Luna
- Le modèle nano d’OpenAI face au Gemini le moins cher de Google, à des prix proches.
- face à Gemini 3.5 Flash-Lite
- Les deux générations de Flash-Lite de Google, la plus récente coûtant davantage en sortie.
Autres modèles de Google
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Gemma 4 31BGoogle · poids ouverts | Aucun tarif public | · | 256K | · |
Source du prix
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026