Tarifs de l’API GLM : 2 modèles, prix par token et par tâche
Les tarifs publics de tous les modèles Z.ai de notre liste, relevés sur la page tarifaire de Z.ai, comparés au coût d’une réponse réussie dans le benchmark AIGROW pour les petites entreprises et à celui de trois tâches courantes avec chaque modèle.
Dollars américains par million de tokens, au tarif standard. Aucun tarif de revendeur.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Tarif public des tokens d’entrée / de sortie par million.
Les prix des 2 modèles de Z.ai figurant dans notre liste vont de GLM-5.3-Flash, à $0.15 en entrée et $0.50 en sortie par million de tokens, à GLM-5.3, à $1.40 en entrée et $4.40 en sortie. Sur le benchmark AIGROW consacré aux petites entreprises, GLM-5.3-Flash a partagé le meilleur résultat, avec 18 tâches réussies sur 20, au coût le plus bas : $0.831 pour mille réussites.
Par token et par réussite
Le tarif public par million de tokens, puis le nombre de tâches de bureau réussies par chaque modèle parmi les 20 du benchmark et le coût de 1,000 réponses réussies, essais ratés compris.
| Modèle | Entrée | Sortie | Entrée en cache | Contexte | Tâches réussies | 1,000 réussites |
|---|---|---|---|---|---|---|
| GLM-5.3Modèles phares | $1.40 | $4.40 | $0.26 | 1M | 18 sur 20 | $7.02 |
| GLM-5.3-FlashPetits modèles rapides | $0.15 | $0.50 | $0.03 | 1M | 18 sur 20 | $0.831 |
Le coût de trois tâches courantes
1,000 exécutions de chaque tâche au tarif public. Les volumes de tokens sont nos estimations ; les tarifs sont ceux de Z.ai.
| Modèle | 1,000 × réponse au support | 1,000 × résumé de document | 1,000 × tâche confiée à un agent |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Réponse au support
- Une requête de 3,000 tokens (le ticket, les échanges précédents et un extrait des règles) et une réponse de 400 tokens.
- Résumé de document
- Un document de 40 pages représentant environ 25,000 tokens en entrée, pour un résumé de 1,000 tokens en sortie.
- Tâche confiée à un agent
- Dix étapes qui lisent au total 80,000 tokens, dont 70,000 tokens de contexte réutilisés d’une étape à l’autre et servis depuis le cache, puis produisent 3,000 tokens.
Les détails tarifaires
Les précisions apportées par les pages tarifaires de Z.ai aux tarifs affichés.
- GLM-5.3
- Le stockage des entrées en cache est « gratuit pour une durée limitée ». Sortie maximale : 128K tokens. Poids ouverts sur Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- 320B paramètres au total, dont 18B actifs. Le stockage des entrées en cache est « gratuit pour une durée limitée ». Z.ai commercialise aussi GLM-5.3-FlashX ($0.37 / $1.25), non inclus ici. Poids ouverts sur Hugging Face (zai-org/GLM-5.3-Flash).
Face-à-face
Les comparatifs mettant un modèle GLM face à un autre, avec les tarifs des deux et le coût de trois tâches avec chacun.
Source des tarifs
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW est décompté aux tarifs publics des éditeurs, comme ceux indiqués ci-dessus, et $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts.
Tarifs vérifiés le 22 septembre 2026