GLM-5.3-Flash face à Qwen3.8 Flash
Deux nouveaux modèles chinois économiques dont les prix ne diffèrent que de quelques centimes. Les tarifs publics des deux modèles, relevés sur les pages de leurs éditeurs, et le coût de trois tâches courantes avec chacun.
Dollars américains, tarif standard, plage de contexte la plus courte. Coût par réussite calculé à partir du benchmark AIGROW pour les petites entreprises.
- GLM-5.3-Flash
- $0.831
- Tâches réussies
- 18 sur 20
- Qwen3.8 Flash
- $1.09
- Tâches réussies
- 19 sur 20
Benchmark AIGROW pour les petites entreprises, essais ratés compris.
Sur le benchmark AIGROW consacré aux petites entreprises, 1 000 réponses réussies coûtent $0.831 avec GLM-5.3-Flash, contre $1.09 avec Qwen3.8 Flash. Ils ont réussi 18 et 19 tâches sur 20. Par million de tokens, GLM-5.3-Flash coûte $0.15 en entrée et $0.50 en sortie et Qwen3.8 Flash, $0.15 en entrée et $0.47 en sortie.
Côte à côte
Le tarif publié par chaque éditeur pour son offre standard. Le tarif de l’entrée en cache s’applique à un début de requête répété une fois qu’il a été stocké par le fournisseur.
| Fait | GLM-5.3-Flash | Qwen3.8 Flash |
|---|---|---|
| Éditeur | Z.ai | Alibaba (Qwen) |
| Gamme | Petits modèles rapides | Petits modèles rapides |
| Entrée, par M de tokens | $0.15 | $0.15 |
| Sortie, par M de tokens | $0.50 | $0.47 |
| Entrée en cache | $0.03 | Non publié |
| Fenêtre de contexte | 1M | 1M |
| Date de sortie | 26 août 2026 | Non publié |
| Poids | Ouvrir | Clôturées |
Le coût d’une tâche avec chaque modèle
1,000 exécutions de chaque tâche aux tarifs publics des deux modèles. L’écart varie selon la tâche, car les modèles facturent différemment l’entrée, la sortie et le contexte en cache.
| Tâche | GLM-5.3-Flash | Qwen3.8 Flash | Moins cher |
|---|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $0.65 | $0.64 | Qwen3.8 Flash, 2 % moins cher |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $4.25 | $4.22 | Égalité |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $5.10 | $13.41 | GLM-5.3-Flash, 62 % moins cher |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent des éditeurs. Si aucun tarif de cache n’est publié pour un modèle, le contexte répété d’une tâche d’agent est facturé au plein tarif des tokens d’entrée.
Les détails tarifaires
Ce que chaque tarif de base ne comprend pas, d’après les pages des éditeurs : majorations, remises, promotions et tarifs de cache.
- GLM-5.3-Flash
- 320B paramètres au total, dont 18B actifs. Le stockage des entrées en cache est « gratuit pour une durée limitée ». Z.ai commercialise aussi GLM-5.3-FlashX ($0.37 / $1.25), non inclus ici. Poids ouverts sur Hugging Face (zai-org/GLM-5.3-Flash). Page des tarifs de Z.ai
- Qwen3.8 Flash
- Déploiement international, avec un seul palier jusqu’à 1M tokens en entrée. Réductions sur le cache identiques à celles de Qwen3.8 Max. Fenêtre de contexte tirée du palier tarifaire supérieur (1M). Page des tarifs d’Alibaba (Qwen)
Autres comparatifs
Tous les face-à-face de la liste où figure GLM-5.3-Flash ou Qwen3.8 Flash.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026