GLM-5.3-Flash: Nutzungskosten
Der Listenpreis von Z.ai für GLM-5.3-Flash, die Kosten für eine Supportantwort, eine Dokumentzusammenfassung und eine Agentenaufgabe sowie die Platzierung unter 37 Modellen.
US-Dollar pro Million Token, Standardtarif, kürzeste Kontextstufe.
- 1,000 Support-Antworten
- $0.65
- Zwischengespeicherte Eingabe
- $0.03
- Kontextfenster
- 1.000.000 Token
- Veröffentlicht
- 26. Aug. 2026
- Modellgewichte
- Öffnen
Aus den eigenen Veröffentlichungen von Z.ai, Stand 22. September 2026.
Über die eigene API von Z.ai kostet GLM-5.3-Flash $0.15 pro Million Input-Token und $0.50 pro Million Output-Token. Für zwischengespeicherte Input-Token sind es $0.03. Bei diesen Preisen kosten 1,000 Antworten auf Supportanfragen $0.65. Damit liegt das Modell auf unserer Liste auf Platz Platz Platz 2. der günstigsten Modelle unter 33 Modellen mit Listenpreis.
Kosten pro Aufgabe
Drei Aufgaben mit jeweils 1,000 Durchläufen, berechnet zum obigen Listenpreis. Dazu die Platzierung von GLM-5.3-Flash unter den 33 Modellen mit Listenpreis.
| Aufgabe | 1,000 Durchläufe | Unter 33 Modellen |
|---|---|---|
| Support-Antwort3,000 Eingabe-Token, 400 Ausgabe-Token. | $0.65 | Platz 2. der günstigsten Modelle |
| Dokumentenzusammenfassung25,000 Eingabe-Token, 1,000 Ausgabe-Token. | $4.25 | Platz 2. der günstigsten Modelle |
| Agentenaufgabe80,000 Eingabe-Token (davon 70,000 aus dem Cache), 3,000 Ausgabe-Token. | $5.10 | am günstigsten |
Die Tokenzahlen stammen von uns und sind so gewählt, dass sie realistischen Aufgaben entsprechen. Die Preise stammen von Z.ai. Jede der drei Aufgaben bleibt unter 200,000 Token pro Anfrage und damit unter allen aufgeführten Aufschlagsschwellen für langen Kontext.
GLM-5.3-Flash bei realen Aufgaben kleiner Unternehmen
Was der AIGROW-Benchmark gemessen hat, als GLM-5.3-Flash 20 Büroaufgaben bearbeitete. Jede Aufgabe wurde anhand fester Kriterien als bestanden oder nicht bestanden bewertet.
- Erfolgsquote
- 90% von 20 Durchläufen bestanden (95-%-Intervall: 70 bis 97 %), Platz 4. von 36 Modellen.
- Kosten pro 1.000 bestandene Durchläufe
- $0.831, einschließlich der fehlgeschlagenen Durchläufe.
- Antwortzeit
- Median: 15 s, 90. Perzentil: 31 s.
- Stärkster und schwächster Bereich
- Terminplanung (100% bestanden) und Produktbeschreibungen (0%).
Das Kleingedruckte
Was im obigen Grundpreis nicht enthalten ist, laut den Seiten des Anbieters: Aufschläge, Rabatte, Aktionen und Cache-Preise.
Insgesamt 320B Parameter, davon 18B aktiv. Die Speicherung zwischengespeicherter Eingaben ist „zeitlich begrenzt kostenlos“. Z.ai bietet außerdem GLM-5.3-FlashX ($0.37 / $1.25) an; dieses Modell ist nicht enthalten. Offene Modellgewichte auf Hugging Face (zai-org/GLM-5.3-Flash).
GLM-5.3-Flash im Vergleich mit den anderen betrachteten Modellen
Jeder Vergleich stellt beide Listenpreise gegenüber und berechnet die Kosten für dieselben drei Aufgaben mit jedem Modell.
- gegen Qwen3.8 Flash
- Zwei neue günstige Modelle aus China, deren Preise nur wenige Cent auseinanderliegen.
Weitere Modelle von Z.ai
| Modell | Eingabe | Ausgabe | Kontext | 1,000 Antworten |
|---|---|---|---|---|
| GLM-5.3Z.ai · offene Modellgewichte | $1.40 | $4.40 | 1M | $5.96 |
Quelle des Preises
Abgerufen am 22. September 2026. Jeder Preis gilt für den Standardtarif in der kürzesten Kontextstufe, ohne Batch- oder Priority-Rabatt. Aufschläge für langen Kontext, Batch-Tarife und Aktionen stehen im Kleingedruckten der jeweiligen Modellseite. Es wurden keine Preise von Wiederverkäufern übernommen.
Nur ein Viertel des Listenpreises zahlen
Das AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet. Für $25 erhalten Sie Nutzung im Wert von $100. Auf der Guthabenseite stehen die abgedeckten Modelle. Fragen Sie vor dem Kauf nach, wenn Sie ein anderes Modell nutzen möchten.
Preise geprüft am 22. September 2026