GPT-5.6 Luna face à Gemini 3.1 Flash-Lite
Le modèle nano d’OpenAI face au Gemini le moins cher de Google, à des prix proches. Les tarifs publics des deux modèles, relevés sur les pages de leurs éditeurs, et le coût de trois tâches courantes avec chacun.
Dollars américains, tarif standard, plage de contexte la plus courte. Coût par réussite calculé à partir du benchmark AIGROW pour les petites entreprises.
- GPT-5.6 Luna
- $0.677
- Tâches réussies
- 16 sur 20
- Gemini 3.1 Flash-Lite
- $1.41
- Tâches réussies
- 9 sur 20
Benchmark AIGROW pour les petites entreprises, essais ratés compris.
Sur le benchmark AIGROW consacré aux petites entreprises, 1 000 réponses réussies coûtent $0.677 avec GPT-5.6 Luna, contre $1.41 avec Gemini 3.1 Flash-Lite. Ils ont réussi 16 et 9 tâches sur 20. Par million de tokens, GPT-5.6 Luna coûte $0.20 en entrée et $1.20 en sortie et Gemini 3.1 Flash-Lite, $0.25 en entrée et $1.50 en sortie.
Côte à côte
Le tarif publié par chaque éditeur pour son offre standard. Le tarif de l’entrée en cache s’applique à un début de requête répété une fois qu’il a été stocké par le fournisseur.
| Fait | GPT-5.6 Luna | Gemini 3.1 Flash-Lite |
|---|---|---|
| Éditeur | OpenAI | |
| Gamme | Petits modèles rapides | Petits modèles rapides |
| Entrée, par M de tokens | $0.20 | $0.25 |
| Sortie, par M de tokens | $1.20 | $1.50 |
| Entrée en cache | $0.02 | $0.025 |
| Fenêtre de contexte | 1.05M | 1.05M |
| Date de sortie | 9 juil. 2026 | 7 mai 2026 |
| Poids | Clôturées | Clôturées |
Le coût d’une tâche avec chaque modèle
1,000 exécutions de chaque tâche aux tarifs publics des deux modèles. L’écart varie selon la tâche, car les modèles facturent différemment l’entrée, la sortie et le contexte en cache.
| Tâche | GPT-5.6 Luna | Gemini 3.1 Flash-Lite | Moins cher |
|---|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $1.08 | $1.35 | GPT-5.6 Luna, 20 % moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $6.20 | $7.75 | GPT-5.6 Luna, 20 % moins cher |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $7.00 | $8.75 | GPT-5.6 Luna, 20 % moins cher |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Si aucun tarif de cache n’est publié pour un modèle, le contexte répété d’une tâche d’agent est facturé au plein tarif des tokens d’entrée.
Les détails tarifaires
Ce que chaque tarif de base ne comprend pas, d’après les pages des éditeurs : majorations, remises, promotions et tarifs de cache.
- GPT-5.6 Luna
- Gamme nano de la famille 5.6. Baisse de prix de 80% le 2026-07-30. Au-delà de 272K tokens en entrée, les requêtes sont facturées 2x pour l’entrée et 1.5x pour la sortie ($0.40 / $1.80). Écriture en cache : $0.25. Batch et Flex : 50% de réduction. La résidence des données ajoute 10%. Page des tarifs d’OpenAI
- Gemini 3.1 Flash-Lite
- Entrée audio : $0.50 ($0.05 en cache). Batch : 50% de réduction. Stockage du cache : $1.00 par MTok et par heure. Page des tarifs de Google
Autres comparatifs
Tous les face-à-face de la liste où figure GPT-5.6 Luna ou Gemini 3.1 Flash-Lite.
Utilisez GPT-5.6 Luna pour un quart de son prix catalogue
Le crédit API AIGROW couvre GPT-5.6 Luna et se décompte aux prix catalogue ci-dessus : $25 donnent droit à $100 d’utilisation.
Tarifs vérifiés le 22 septembre 2026