GLM-5.3-Flash : combien coûte son utilisation
Le prix affiché par Z.ai pour GLM-5.3-Flash, le coût d’une réponse au support client, d’un résumé de document et d’une tâche d’agent, ainsi que son rang parmi 37 modèles.
Dollars américains par million de tokens, tarif standard, tranche de contexte la plus courte.
- 1,000 réponses au support
- $0.65
- Entrée en cache
- $0.03
- Fenêtre de contexte
- 1 000 000 tokens
- Date de sortie
- 26 août 2026
- Poids
- Ouvrir
D’après les pages de Z.ai, le 22 septembre 2026.
Sur l’API de Z.ai, GLM-5.3-Flash coûte $0.15 par million de tokens d’entrée et $0.50 par million de tokens de sortie, et $0.03 pour les tokens d’entrée mis en cache. À ces tarifs, 1,000 réponses au support client coûtent $0.65, ce qui le place le 2e parmi les moins chers sur 33 modèles tarifés dans notre liste.
Le coût d’une tâche
Trois tâches, 1,000 exécutions de chacune, au prix catalogue ci-dessus, avec le rang de GLM-5.3-Flash pour chacune parmi les 33 modèles ayant un prix catalogue.
| Tâche | 1,000 exécutions | Parmi 33 |
|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $0.65 | 2e parmi les moins chers |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $4.25 | 2e parmi les moins chers |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $5.10 | le moins cher |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent de Z.ai. Chacune des trois tâches reste sous 200,000 tokens par requête, en deçà de toutes les majorations pour contexte long de la liste.
GLM-5.3-Flash face aux tâches réelles d’une petite entreprise
Ce que le benchmark AIGROW a mesuré en soumettant 20 tâches de bureau à GLM-5.3-Flash, chacune évaluée comme réussie ou échouée selon des critères fixes.
- Taux de réussite
- 90% des 20 exécutions ont réussi (intervalle à 95 % : 70 à 97 %), 4e sur 36 modèles.
- Coût pour 1 000 tâches réussies
- $0.831, exécutions échouées comprises.
- Temps de réponse
- Médiane de 15 s, 31 s au 90e percentile.
- Meilleur et moins bon résultat
- Prise de rendez-vous (100% de réussite) et Descriptions de produits (0%).
Les détails tarifaires
Ce que le tarif de base ci-dessus ne comprend pas, d’après les pages de l’éditeur : majorations, remises, promotions et tarifs de cache.
320B paramètres au total, dont 18B actifs. Le stockage des entrées en cache est « gratuit pour une durée limitée ». Z.ai commercialise aussi GLM-5.3-FlashX ($0.37 / $1.25), non inclus ici. Poids ouverts sur Hugging Face (zai-org/GLM-5.3-Flash).
GLM-5.3-Flash face aux modèles auxquels il est comparé
Chaque comparatif présente les deux prix catalogue côte à côte et calcule le coût des trois mêmes tâches pour chaque modèle.
- face à Qwen3.8 Flash
- Deux nouveaux modèles chinois économiques dont les prix ne diffèrent que de quelques centimes.
Autres modèles de Z.ai
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| GLM-5.3Z.ai · poids ouverts | $1.40 | $4.40 | 1M | $5.96 |
Source du prix
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026