GPT-5.6 Luna face à Gemini 3.5 Flash-Lite
Les derniers modèles économiques d’OpenAI et de Google, tous deux destinés aux tâches à gros volume. Les tarifs publics des deux modèles, relevés sur les pages de leurs éditeurs, et le coût de trois tâches courantes avec chacun.
Dollars américains, tarif standard, plage de contexte la plus courte. Coût par réussite calculé à partir du benchmark AIGROW pour les petites entreprises.
- GPT-5.6 Luna
- $0.677
- Tâches réussies
- 16 sur 20
- Gemini 3.5 Flash-Lite
- $2.47
- Tâches réussies
- 7 sur 20
Benchmark AIGROW pour les petites entreprises, essais ratés compris.
Sur le benchmark AIGROW consacré aux petites entreprises, 1 000 réponses réussies coûtent $0.677 avec GPT-5.6 Luna, contre $2.47 avec Gemini 3.5 Flash-Lite. Ils ont réussi 16 et 7 tâches sur 20. Par million de tokens, GPT-5.6 Luna coûte $0.20 en entrée et $1.20 en sortie et Gemini 3.5 Flash-Lite, $0.30 en entrée et $2.50 en sortie.
Côte à côte
Le tarif publié par chaque éditeur pour son offre standard. Le tarif de l’entrée en cache s’applique à un début de requête répété une fois qu’il a été stocké par le fournisseur.
| Fait | GPT-5.6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|
| Éditeur | OpenAI | |
| Gamme | Petits modèles rapides | Petits modèles rapides |
| Entrée, par M de tokens | $0.20 | $0.30 |
| Sortie, par M de tokens | $1.20 | $2.50 |
| Entrée en cache | $0.02 | $0.03 |
| Fenêtre de contexte | 1.05M | 1.05M |
| Date de sortie | 9 juil. 2026 | 21 juil. 2026 |
| Poids | Clôturées | Clôturées |
Le coût d’une tâche avec chaque modèle
1,000 exécutions de chaque tâche aux tarifs publics des deux modèles. L’écart varie selon la tâche, car les modèles facturent différemment l’entrée, la sortie et le contexte en cache.
| Tâche | GPT-5.6 Luna | Gemini 3.5 Flash-Lite | Moins cher |
|---|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $1.08 | $1.90 | GPT-5.6 Luna, 43 % moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $6.20 | $10.00 | GPT-5.6 Luna, 38 % moins cher |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $7.00 | $12.60 | GPT-5.6 Luna, 44 % moins cher |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Si aucun tarif de cache n’est publié pour un modèle, le contexte répété d’une tâche d’agent est facturé au plein tarif des tokens d’entrée.
Les détails tarifaires
Ce que chaque tarif de base ne comprend pas, d’après les pages des éditeurs : majorations, remises, promotions et tarifs de cache.
- GPT-5.6 Luna
- Gamme nano de la famille 5.6. Baisse de prix de 80% le 2026-07-30. Au-delà de 272K tokens en entrée, les requêtes sont facturées 2x pour l’entrée et 1.5x pour la sortie ($0.40 / $1.80). Écriture en cache : $0.25. Batch et Flex : 50% de réduction. La résidence des données ajoute 10%. Page des tarifs d’OpenAI
- Gemini 3.5 Flash-Lite
- Même tarif pour les entrées texte, image, vidéo et audio. Batch : 50% de réduction. Stockage du cache : $1.00 par MTok et par heure. Page des tarifs de Google
Autres comparatifs
Tous les face-à-face de la liste où figure GPT-5.6 Luna ou Gemini 3.5 Flash-Lite.
- GPT-5.6 Luna face à Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 face à GPT-5.6 Luna
- GPT-5.4 mini face à GPT-5.6 Luna
- GPT-5.4 nano face à GPT-5.6 Luna
- Gemini 3.5 Flash-Lite face à Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash face à GPT-5.6 Luna
- DeepSeek V4.1 Flash face à Gemini 3.5 Flash-Lite
- Mistral Small 4 face à GPT-5.6 Luna
Utilisez les deux pour un quart de leur prix catalogue
Le crédit API AIGROW couvre GPT-5.6 Luna and Gemini 3.5 Flash-Lite et se décompte aux prix catalogue ci-dessus : $25 donnent droit à $100 d’utilisation.
Tarifs vérifiés le 22 septembre 2026