API-priser for GLM: 2 modeller, pris pr. token og pr. opgave
Listeprisen for hver Z.ai-model på vores liste, hentet fra Z.ais egen prisside, sammen med prisen for et bestået svar i AIGROWs benchmark for små virksomheder og prisen for tre almindelige opgaver med hver model.
Amerikanske dollar pr. million tokens til standardpris. Ingen forhandlerpriser.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Listepris for input og output pr. million tokens.
Z.ais 2 modeller på vores liste koster fra GLM-5.3-Flash til $0.15 ind og $0.50 ud pr. million tokens til GLM-5.3 til $1.40 ind og $4.40 ud. I AIGROWs benchmark for små virksomheder delte GLM-5.3-Flash førstepladsen med 18 beståede opgaver ud af 20 og havde den laveste pris: $0.831 pr. tusind beståede opgaver.
Pr. token og pr. bestået opgave
Se listeprisen pr. million tokens, hvor mange af benchmarkens 20 kontoropgaver hver model bestod, og hvad 1.000 beståede svar koster, inklusive mislykkede forsøg.
| Model | Input | Output | Cachelagret input | Kontekst | Beståede opgaver | 1.000 beståede opgaver |
|---|---|---|---|---|---|---|
| GLM-5.3Topmodeller | $1.40 | $4.40 | $0.26 | 1M | 18 af 20 | $7.02 |
| GLM-5.3-FlashSmå og hurtige | $0.15 | $0.50 | $0.03 | 1M | 18 af 20 | $0.831 |
Hvad tre almindelige opgaver koster
1,000 gennemløb af hver opgave til listepris. Vi har fastsat antallet af tokens, mens priserne er Z.ais.
| Model | 1,000 × supportsvar | 1,000 × dokumentresumé | 1,000 × agentopgave |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Supportsvar
- En forespørgsel på 3.000 tokens (henvendelsen, den hidtidige samtale og et uddrag af retningslinjerne) og et svar på 400 tokens.
- Dokumentresumé
- Et dokument på 40 sider med cirka 25.000 tokens som input og et resumé på 1.000 tokens som output.
- Agentopgave
- Ti trin, der tilsammen læser 80.000 tokens, hvoraf 70.000 er kontekst, som gentages fra trin til trin og hentes fra cache. Opgaven skriver 3.000 tokens.
Det med småt
Hvad Z.ais prissider oplyser ud over de fremhævede priser.
- GLM-5.3
- Lagring af cachelagret input er »Limited-time Free«. Maksimalt output er 128K. Åbne vægte på Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- 320B parametre i alt, heraf 18B aktive. Lagring af cachelagret input er »Limited-time Free«. Z.ai sælger også GLM-5.3-FlashX ($0.37 / $1.25), som ikke er medtaget. Åbne vægte på Hugging Face (zai-org/GLM-5.3-Flash).
Direkte sammenligning
Sammenligninger med en GLM-model på den ene side. Hver sammenligning viser begge priser og omkostningerne ved tre opgaver med hver model.
Hvor priserne kommer fra
Tjekket 22. september 2026. Hver pris er standardprisen for det korteste kontekstinterval, uden batch- eller prioritetsrabat. Tillæg for lang kontekst, batchpriser og kampagner fremgår af det med småt på hver modelside. Ingen priser stammer fra en forhandler.
Betal en fjerdedel af listeprisen
AIGROW API-kredit afregnes efter producenternes listepriser som dem ovenfor, og $25 giver $100 i forbrug. På siden om kredit kan du se, hvilke modeller den dækker.
Priser tjekket 22. september 2026