GLM-5.3 : combien coûte son utilisation
Le prix affiché par Z.ai pour GLM-5.3, le coût d’une réponse au support client, d’un résumé de document et d’une tâche d’agent, ainsi que son rang parmi 37 modèles.
Dollars américains par million de tokens, tarif standard, tranche de contexte la plus courte.
- 1,000 réponses au support
- $5.96
- Entrée en cache
- $0.26
- Fenêtre de contexte
- 1 000 000 tokens
- Date de sortie
- 18 août 2026
- Poids
- Ouvrir
D’après les pages de Z.ai, le 22 septembre 2026.
Sur l’API de Z.ai, GLM-5.3 coûte $1.40 par million de tokens d’entrée et $4.40 par million de tokens de sortie, et $0.26 pour les tokens d’entrée mis en cache. À ces tarifs, 1,000 réponses au support client coûtent $5.96, ce qui le place le 14e parmi les plus chers sur 33 modèles tarifés dans notre liste.
Le coût d’une tâche
Trois tâches, 1,000 exécutions de chacune, au prix catalogue ci-dessus, avec le rang de GLM-5.3 pour chacune parmi les 33 modèles ayant un prix catalogue.
| Tâche | 1,000 exécutions | Parmi 33 |
|---|---|---|
| Réponse au support3,000 en entrée, 400 en sortie. | $5.96 | 14e parmi les plus chers |
| Résumé de document25,000 en entrée, 1,000 en sortie. | $39.40 | 14e parmi les plus chers |
| Tâche confiée à un agent80,000 en entrée (dont 70,000 en cache), 3,000 en sortie. | $45.40 | 15e parmi les plus chers |
Les volumes de tokens sont nos estimations, choisies pour représenter des tâches réelles ; les prix viennent de Z.ai. Chacune des trois tâches reste sous 200,000 tokens par requête, en deçà de toutes les majorations pour contexte long de la liste.
GLM-5.3 face aux tâches réelles d’une petite entreprise
Ce que le benchmark AIGROW a mesuré en soumettant 20 tâches de bureau à GLM-5.3, chacune évaluée comme réussie ou échouée selon des critères fixes.
- Taux de réussite
- 90% des 20 exécutions ont réussi (intervalle à 95 % : 70 à 97 %), 4e sur 36 modèles.
- Coût pour 1 000 tâches réussies
- $7.02, exécutions échouées comprises.
- Temps de réponse
- Médiane de 9.2 s, 31 s au 90e percentile.
- Meilleur et moins bon résultat
- Prise de rendez-vous (100% de réussite) et Réponses aux avis (0%).
Les détails tarifaires
Ce que le tarif de base ci-dessus ne comprend pas, d’après les pages de l’éditeur : majorations, remises, promotions et tarifs de cache.
Le stockage des entrées en cache est « gratuit pour une durée limitée ». Sortie maximale : 128K tokens. Poids ouverts sur Hugging Face (zai-org/GLM-5.3).
GLM-5.3 face aux modèles auxquels il est comparé
Chaque comparatif présente les deux prix catalogue côte à côte et calcule le coût des trois mêmes tâches pour chaque modèle.
- face à DeepSeek V4 Pro
- Des modèles chinois de pointe à poids ouverts, dans la même gamme de prix.
- face à Kimi K3
- Des modèles de pointe à poids ouverts sortis à moins de deux mois d’intervalle, Kimi coûtant deux à trois fois plus cher.
Autres modèles de Z.ai
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| GLM-5.3-FlashZ.ai · poids ouverts | $0.15 | $0.50 | 1M | $0.65 |
Source du prix
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026