API-prijzen van GLM: 2 modellen, per token en per taak
De lijstprijs van elk model van Z.ai in ons overzicht, afkomstig van de prijspagina van Z.ai, naast de kosten van een geslaagd antwoord in de AIGROW-benchmark voor kleine bedrijven en de kosten van drie alledaagse taken per model.
Amerikaanse dollars per miljoen tokens, tegen het standaardtarief. Geen wederverkopersprijzen.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Lijstprijs voor input / output per miljoen tokens.
De prijzen van Z.ai voor de 2 modellen op onze lijst lopen van GLM-5.3-Flash voor $0.15 invoer en $0.50 uitvoer per miljoen tokens tot GLM-5.3 voor $1.40 invoer en $4.40 uitvoer. In de AIGROW-benchmark voor kleine bedrijven deelde GLM-5.3-Flash de beste score: 18 van 20 taken geslaagd, tegen de laagste kosten van $0.831 per duizend geslaagde pogingen.
Per token en per geslaagde taak
Eerst de lijstprijs per miljoen tokens, daarna hoeveel van de 20 kantoortaken uit de benchmark elk model voltooide en wat 1.000 geslaagde antwoorden kosten, inclusief mislukte pogingen.
| Model | Input | Output | Gecachte input | Context | Geslaagde taken | 1.000 geslaagde taken |
|---|---|---|---|---|---|---|
| GLM-5.3Topmodellen | $1.40 | $4.40 | $0.26 | 1M | 18 van 20 | $7.02 |
| GLM-5.3-FlashKlein en snel | $0.15 | $0.50 | $0.03 | 1M | 18 van 20 | $0.831 |
Wat drie alledaagse taken kosten
1,000 uitvoeringen van elke taak tegen de lijstprijs. De aantallen tokens zijn van ons; de prijzen zijn van Z.ai.
| Model | 1,000 × antwoord op een supportvraag | 1,000 × documentsamenvatting | 1,000 × agenttaak |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Antwoord op een supportvraag
- Een prompt van 3.000 tokens (het ticket, de voorgaande berichten en een fragment uit het beleid) en een antwoord van 400 tokens.
- Documentsamenvatting
- Een document van 40 pagina's, ongeveer 25.000 inputtokens, met een samenvatting van 1.000 outputtokens.
- Agenttaak
- Tien stappen die samen 80.000 tokens lezen, waarvan 70.000 tokens bestaan uit context die van stap tot stap wordt herhaald en uit de cache komt, en 3.000 tokens schrijven.
De kleine lettertjes
Wat de prijspagina's van Z.ai nog vermelden naast de hoofdprijzen.
- GLM-5.3
- Opslag van invoer in de cache is 'Tijdelijk gratis'. Maximaal 128K uitvoertokens. Open weights op Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- In totaal 320B parameters, waarvan 18B actief. Opslag van invoer in de cache is 'Tijdelijk gratis'. Z.ai verkoopt ook GLM-5.3-FlashX ($0.37 / $1.25), hier niet opgenomen. Open weights op Hugging Face (zai-org/GLM-5.3-Flash).
Direct vergeleken
Vergelijkingen waarin een model van GLM tegenover een ander model staat, met de prijzen en de kosten van drie taken voor beide.
Waar de prijzen vandaan komen
Geraadpleegd op 22 september 2026. Elke prijs is het standaardtarief voor het kortste contextbereik, zonder batch- of prioriteitskorting. Toeslagen voor lange context, batchtarieven en aanbiedingen staan in de details bij elk model. Geen enkele prijs komt van een wederverkoper.
Betaal een kwart van de lijstprijs
AIGROW API-tegoed wordt berekend tegen de lijstprijzen van de makers, zoals hierboven. Voor $25 krijg je $100 aan gebruik. Op de pagina over API-tegoed staat voor welke modellen het geldt.
Prijzen gecontroleerd op 22 september 2026