Qwen3.8 Flash : combien coûte son utilisation
Le prix affiché par Alibaba (Qwen) pour Qwen3.8 Flash, le coût d’une réponse au support client, d’un résumé de document et d’une tâche d’agent, ainsi que son rang parmi 37 modèles.
Dollars américains par million de tokens, tarif standard, tranche de contexte la plus courte.
- 1,000 réponses au support
- $0.64
- Entrée en cache
- Non publié
- Fenêtre de contexte
- 1 000 000 tokens
- Date de sortie
- Non publié
- Poids
- Clôturées
D’après les pages d’Alibaba (Qwen), le 22 septembre 2026.
Sur l’API d’Alibaba (Qwen), Qwen3.8 Flash coûte $0.15 par million de tokens d’entrée et $0.47 par million de tokens de sortie. À ces tarifs, 1,000 réponses au support client coûtent $0.64, ce qui le place le le moins cher sur 33 modèles tarifés dans notre liste.
Le coût d’une tâche
Trois tâches, 1,000 exécutions de chacune, au prix catalogue ci-dessus, avec le rang de Qwen3.8 Flash pour chacune parmi les 33 modèles ayant un prix catalogue.
| Tâche | 1,000 exécutions | Parmi 33 |
|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $0.64 | le moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $4.22 | le moins cher |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $13.41 | 8e parmi les moins chers |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent d’Alibaba (Qwen). Chacune des trois tâches reste sous 200,000 tokens par requête, en deçà de toutes les majorations pour contexte long de la liste. Alibaba (Qwen) ne publie aucun tarif de cache pour ce modèle. Le contexte répété de la tâche d’agent est donc facturé au plein tarif des tokens d’entrée.
Qwen3.8 Flash face aux tâches réelles d’une petite entreprise
Ce que le benchmark AIGROW a mesuré en soumettant 20 tâches de bureau à Qwen3.8 Flash, chacune évaluée comme réussie ou échouée selon des critères fixes.
- Taux de réussite
- 95% des 20 exécutions ont réussi (intervalle à 95 % : 76 à 99 %), 1er sur 36 modèles.
- Coût pour 1 000 tâches réussies
- $1.09, exécutions échouées comprises.
- Temps de réponse
- Médiane de 29 s, 44 s au 90e percentile.
- Meilleur et moins bon résultat
- Prise de rendez-vous (100% de réussite) et Devis (50%).
Les détails tarifaires
Ce que le tarif de base ci-dessus ne comprend pas, d’après les pages de l’éditeur : majorations, remises, promotions et tarifs de cache.
Déploiement international, avec un seul palier jusqu’à 1M tokens en entrée. Réductions sur le cache identiques à celles de Qwen3.8 Max. Fenêtre de contexte tirée du palier tarifaire supérieur (1M).
Qwen3.8 Flash face aux modèles auxquels il est comparé
Chaque comparatif présente les deux prix catalogue côte à côte et calcule le coût des trois mêmes tâches pour chaque modèle.
- face à DeepSeek V4.1 Flash
- Des API chinoises économiques, le tarif catalogue de Qwen représentant environ la moitié du tarif de pointe de DeepSeek.
- face à GLM-5.3-Flash
- Deux nouveaux modèles chinois économiques dont les prix ne diffèrent que de quelques centimes.
Autres modèles d’Alibaba (Qwen)
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| Qwen3.7 PlusAlibaba (Qwen) | $0.40 | $1.60 | 1M | $1.84 |
| Qwen3.8 27BAlibaba (Qwen) · poids ouverts | $0.50 | $3.00 | 1M | $2.70 |
| Qwen3.8 MaxAlibaba (Qwen) | $2.00 | $6.00 | 1M | $8.40 |
Source du prix
- Alibaba (Qwen)
- alibabacloud.com/help/en/model-studio/model-pricing
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026