GLM API-Preise: 2 Modelle, Kosten pro Token und Aufgabe
Der Listenpreis jedes Z.ai-Modells in unserer Übersicht, entnommen aus der Preisseite von Z.ai, zusammen mit den Kosten für eine erfolgreiche Antwort im AIGROW Benchmark für kleine Unternehmen und für drei alltägliche Aufgaben pro Modell.
US-Dollar pro Million Tokens zum Standardtarif. Keine Reseller-Preise.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Listenpreis für Eingabe/Ausgabe pro Million Tokens.
Die 2 Modelle von Z.ai auf unserer Liste reichen preislich von GLM-5.3-Flash mit $0.15 Input-Token und $0.50 Output-Token pro Million Token bis GLM-5.3 mit $1.40 Input-Token und $4.40 Output-Token. Im AIGROW-Benchmark für kleine Unternehmen teilte sich GLM-5.3-Flash den Bestwert: 18 von 20 Aufgaben bestanden, bei den niedrigsten Kosten von $0.831 pro tausend bestandene Durchläufe.
Pro Token und erfolgreichem Durchlauf
Der Listenpreis pro Million Tokens, wie viele der 20 Büroaufgaben im Benchmark jedes Modell erfolgreich erledigt hat und was 1.000 erfolgreiche Antworten kosten, fehlgeschlagene Durchläufe eingeschlossen.
| Modell | Eingabe | Ausgabe | Zwischengespeicherte Eingabe | Kontext | Erfolgreich erledigte Aufgaben | 1.000 erfolgreiche Durchläufe |
|---|---|---|---|---|---|---|
| GLM-5.3Flaggschiffmodelle | $1.40 | $4.40 | $0.26 | 1M | 18 von 20 | $7.02 |
| GLM-5.3-FlashKlein und schnell | $0.15 | $0.50 | $0.03 | 1M | 18 von 20 | $0.831 |
Kosten für drei alltägliche Aufgaben
Je 1,000 Durchläufe pro Aufgabe zum Listenpreis. Die Token-Mengen stammen von uns, die Preise von Z.ai.
| Modell | 1,000 × Support-Antwort | 1,000 × Dokumentenzusammenfassung | 1,000 × Agentenaufgabe |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Support-Antwort
- Eine Anfrage mit 3.000 Tokens (das Ticket, der bisherige Nachrichtenverlauf und ein Auszug aus den Richtlinien) und eine Antwort mit 400 Tokens.
- Dokumentenzusammenfassung
- Ein 40-seitiges Dokument mit etwa 25.000 Eingabe-Tokens und eine Zusammenfassung mit 1.000 Ausgabe-Tokens.
- Agentenaufgabe
- Zehn Schritte, die zusammen 80.000 Tokens lesen, davon 70.000 Tokens als von Schritt zu Schritt wiederholter Kontext aus dem Cache, und 3.000 Tokens schreiben.
Das Kleingedruckte
Was auf den Preisseiten von Z.ai zusätzlich zu den Grundpreisen steht.
- GLM-5.3
- Die Speicherung zwischengespeicherter Eingaben ist „zeitlich begrenzt kostenlos“. Maximale Ausgabelänge: 128K. Offene Modellgewichte auf Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- Insgesamt 320B Parameter, davon 18B aktiv. Die Speicherung zwischengespeicherter Eingaben ist „zeitlich begrenzt kostenlos“. Z.ai bietet außerdem GLM-5.3-FlashX ($0.37 / $1.25) an; dieses Modell ist nicht enthalten. Offene Modellgewichte auf Hugging Face (zai-org/GLM-5.3-Flash).
Direkter Vergleich
Vergleiche, bei denen auf einer Seite ein Modell von GLM steht, jeweils mit den Preisen beider Modelle und den Kosten für drei Aufgaben.
Woher die Preise stammen
Abgerufen am 22. September 2026. Jeder Preis gilt für den Standardtarif in der kürzesten Kontextstufe, ohne Batch- oder Priority-Rabatt. Aufschläge für langen Kontext, Batch-Tarife und Aktionen stehen im Kleingedruckten der jeweiligen Modellseite. Es wurden keine Preise von Wiederverkäufern übernommen.
Nur ein Viertel des Listenpreises zahlen
AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet, wie oben gezeigt. Für $25 erhalten Sie ein Nutzungsguthaben von $100. Auf der Seite zum Guthaben stehen die abgedeckten Modelle.
Preise geprüft am 22. September 2026