Qwen3.7 Plus face à Gemini 3.8 Flash
Deux modèles de milieu de gamme à bas prix et à longue fenêtre de contexte, adaptés au traitement de gros volumes de texte. Les tarifs publics des deux modèles, relevés sur les pages de leurs éditeurs, et le coût de trois tâches courantes avec chacun.
Dollars américains, tarif standard, plage de contexte la plus courte. Coût par réussite calculé à partir du benchmark AIGROW pour les petites entreprises.
- Qwen3.7 Plus
- $3.58
- Tâches réussies
- 17 sur 20
- Gemini 3.8 Flash
- $7.17
- Tâches réussies
- 18 sur 20
Benchmark AIGROW pour les petites entreprises, essais ratés compris.
Sur le benchmark AIGROW consacré aux petites entreprises, 1 000 réponses réussies coûtent $3.58 avec Qwen3.7 Plus, contre $7.17 avec Gemini 3.8 Flash. Ils ont réussi 17 et 18 tâches sur 20. Par million de tokens, Qwen3.7 Plus coûte $0.40 en entrée et $1.60 en sortie et Gemini 3.8 Flash, $0.75 en entrée et $3.75 en sortie.
Côte à côte
Le tarif publié par chaque éditeur pour son offre standard. Le tarif de l’entrée en cache s’applique à un début de requête répété une fois qu’il a été stocké par le fournisseur.
| Fait | Qwen3.7 Plus | Gemini 3.8 Flash |
|---|---|---|
| Éditeur | Alibaba (Qwen) | |
| Gamme | Modèles polyvalents | Modèles polyvalents |
| Entrée, par M de tokens | $0.40 | $0.75 |
| Sortie, par M de tokens | $1.60 | $3.75 |
| Entrée en cache | Non publié | $0.075 |
| Fenêtre de contexte | 1M | 1.05M |
| Date de sortie | Non publié | 2 sept. 2026 |
| Poids | Clôturées | Clôturées |
Le coût d’une tâche avec chaque modèle
1,000 exécutions de chaque tâche aux tarifs publics des deux modèles. L’écart varie selon la tâche, car les modèles facturent différemment l’entrée, la sortie et le contexte en cache.
| Tâche | Qwen3.7 Plus | Gemini 3.8 Flash | Moins cher |
|---|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $1.84 | $3.75 | Qwen3.7 Plus, 51 % moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $11.60 | $22.50 | Qwen3.7 Plus, 48 % moins cher |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $36.80 | $24.00 | Gemini 3.8 Flash, 35 % moins cher |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Si aucun tarif de cache n’est publié pour un modèle, le contexte répété d’une tâche d’agent est facturé au plein tarif des tokens d’entrée.
Les détails tarifaires
Ce que chaque tarif de base ne comprend pas, d’après les pages des éditeurs : majorations, remises, promotions et tarifs de cache.
- Qwen3.7 Plus
- Présenté comme « prix catalogue (réduction temporaire de 20%) » : le prix catalogue est retenu ; le tarif réduit serait de $0.32 / $1.28. De 256K à 1M tokens en entrée : prix catalogue de $1.20 / $4.80. Version qwen3.7-plus-2026-05-26. Déploiement international. Réductions sur le cache identiques à celles de Qwen3.8 Max. Fenêtre de contexte tirée du palier tarifaire supérieur (1M). Page des tarifs d’Alibaba (Qwen)
- Gemini 3.8 Flash
- Tarif de lancement jusqu’au 2026-12-31 ; à compter du 2027-01-01, il passera à $1.50 / $7.50, et à $0.15 pour l’entrée en cache. Batch et Flex : 50% de réduction ; Priority : $1.35 / $6.75. Stockage du cache : $0.50 par MTok et par heure (puis $1.00). Page des tarifs de Google
Autres comparatifs
Tous les face-à-face de la liste où figure Qwen3.7 Plus ou Gemini 3.8 Flash.
Utilisez Gemini 3.8 Flash pour un quart de son prix catalogue
Le crédit API AIGROW couvre Gemini 3.8 Flash et se décompte aux prix catalogue ci-dessus : $25 donnent droit à $100 d’utilisation.
Tarifs vérifiés le 22 septembre 2026