DeepSeek V4.1 Flash face à GPT-5.6 Luna
Deux API à bas prix pour les gros volumes, DeepSeek étant encore moins cher en heures creuses. Les tarifs publics des deux modèles, relevés sur les pages de leurs éditeurs, et le coût de trois tâches courantes avec chacun.
Dollars américains, tarif standard, plage de contexte la plus courte. Coût par réussite calculé à partir du benchmark AIGROW pour les petites entreprises.
- DeepSeek V4.1 Flash
- $1.05
- Tâches réussies
- 18 sur 20
- GPT-5.6 Luna
- $0.677
- Tâches réussies
- 16 sur 20
Benchmark AIGROW pour les petites entreprises, essais ratés compris.
Sur le benchmark AIGROW consacré aux petites entreprises, 1 000 réponses réussies coûtent $0.677 avec GPT-5.6 Luna, contre $1.05 avec DeepSeek V4.1 Flash. Ils ont réussi 16 et 18 tâches sur 20. Par million de tokens, DeepSeek V4.1 Flash coûte $0.30 en entrée et $1.20 en sortie et GPT-5.6 Luna, $0.20 en entrée et $1.20 en sortie.
Côte à côte
Le tarif publié par chaque éditeur pour son offre standard. Le tarif de l’entrée en cache s’applique à un début de requête répété une fois qu’il a été stocké par le fournisseur.
| Fait | DeepSeek V4.1 Flash | GPT-5.6 Luna |
|---|---|---|
| Éditeur | DeepSeek | OpenAI |
| Gamme | Petits modèles rapides | Petits modèles rapides |
| Entrée, par M de tokens | $0.30 | $0.20 |
| Sortie, par M de tokens | $1.20 | $1.20 |
| Entrée en cache | $0.006 | $0.02 |
| Fenêtre de contexte | 1M | 1.05M |
| Date de sortie | 10 sept. 2026 | 9 juil. 2026 |
| Poids | Ouvrir | Clôturées |
Le coût d’une tâche avec chaque modèle
1,000 exécutions de chaque tâche aux tarifs publics des deux modèles. L’écart varie selon la tâche, car les modèles facturent différemment l’entrée, la sortie et le contexte en cache.
| Tâche | DeepSeek V4.1 Flash | GPT-5.6 Luna | Moins cher |
|---|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $1.38 | $1.08 | GPT-5.6 Luna, 22 % moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $8.70 | $6.20 | GPT-5.6 Luna, 29 % moins cher |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $7.02 | $7.00 | Égalité |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Si aucun tarif de cache n’est publié pour un modèle, le contexte répété d’une tâche d’agent est facturé au plein tarif des tokens d’entrée.
Les détails tarifaires
Ce que chaque tarif de base ne comprend pas, d’après les pages des éditeurs : majorations, remises, promotions et tarifs de cache.
- DeepSeek V4.1 Flash
- Tarif des heures de pointe, retenu comme prix catalogue. Hors pointe, le tarif est réduit de moitié : $0.15 / $0.60, accès au cache $0.003. Nom d’API : deepseek-flash. Sortie maximale : 384K tokens. Page des tarifs de DeepSeek
- GPT-5.6 Luna
- Gamme nano de la famille 5.6. Baisse de prix de 80% le 2026-07-30. Au-delà de 272K tokens en entrée, les requêtes sont facturées 2x pour l’entrée et 1.5x pour la sortie ($0.40 / $1.80). Écriture en cache : $0.25. Batch et Flex : 50% de réduction. La résidence des données ajoute 10%. Page des tarifs d’OpenAI
Autres comparatifs
Tous les face-à-face de la liste où figure DeepSeek V4.1 Flash ou GPT-5.6 Luna.
- gpt-oss-120b face à DeepSeek V4.1 Flash
- GPT-5.6 Luna face à Gemini 3.5 Flash-Lite
- GPT-5.6 Luna face à Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 face à GPT-5.6 Luna
- GPT-5.4 mini face à GPT-5.6 Luna
- GPT-5.4 nano face à GPT-5.6 Luna
- DeepSeek V4.1 Flash face à Gemini 3.5 Flash-Lite
- Qwen3.8 Flash face à DeepSeek V4.1 Flash
- Mistral Small 4 face à GPT-5.6 Luna
- Grok 4.3 face à DeepSeek V4.1 Flash
Utilisez les deux pour un quart de leur prix catalogue
Le crédit API AIGROW couvre DeepSeek V4.1 Flash and GPT-5.6 Luna et se décompte aux prix catalogue ci-dessus : $25 donnent droit à $100 d’utilisation.
Tarifs vérifiés le 22 septembre 2026