GLM-5.3-Flash vs. Qwen3.8 Flash
Zwei neue günstige Modelle aus China, deren Preise nur wenige Cent auseinanderliegen. Dazu die Listenpreise beider Modelle von den Seiten ihrer Anbieter und die Kosten für drei alltägliche Aufgaben mit jedem Modell.
US-Dollar, Standardtarif, kleinste Kontextfenster-Stufe. Kosten pro erfolgreichem Durchlauf aus dem AIGROW-Benchmark für kleine Unternehmen.
- GLM-5.3-Flash
- $0.831
- Erfolgreich erledigte Aufgaben
- 18 von 20
- Qwen3.8 Flash
- $1.09
- Erfolgreich erledigte Aufgaben
- 19 von 20
AIGROW-Benchmark für kleine Unternehmen, fehlgeschlagene Durchläufe eingeschlossen.
Im AIGROW-Benchmark für kleine Unternehmen kostet GLM-5.3-Flash $0.831 pro 1.000 bestandene Antworten, Qwen3.8 Flash dagegen $1.09. Von 20 Aufgaben bestanden sie 18 beziehungsweise 19. Pro Million Token kostet GLM-5.3-Flash $0.15 Input-Token und $0.50 Output-Token, Qwen3.8 Flash kostet $0.15 Input-Token und $0.47 Output-Token.
Im direkten Vergleich
Der veröffentlichte Preis jedes Anbieters für seinen Standardtarif. Der Preis für zwischengespeicherte Eingaben gilt für einen wiederholten Anfangsteil der Anfrage, sobald der Anbieter ihn gespeichert hat.
| Fakt | GLM-5.3-Flash | Qwen3.8 Flash |
|---|---|---|
| Anbieter | Z.ai | Alibaba (Qwen) |
| Leistungsklasse | Klein und schnell | Klein und schnell |
| Eingabe pro Mio. Tokens | $0.15 | $0.15 |
| Ausgabe pro Mio. Tokens | $0.50 | $0.47 |
| Zwischengespeicherte Eingabe | $0.03 | Nicht veröffentlicht |
| Kontextfenster | 1M | 1M |
| Veröffentlicht | 26. Aug. 2026 | Nicht veröffentlicht |
| Modellgewichte | Öffnen | Abgeschlossen |
Kosten pro Aufgabe mit jedem Modell
Je 1,000 Durchläufe pro Aufgabe zu den beiden Listenpreisen. Der Preisunterschied variiert je nach Aufgabe, weil die Modelle Eingabe, Ausgabe und zwischengespeicherten Kontext unterschiedlich bepreisen.
| Aufgabe | GLM-5.3-Flash | Qwen3.8 Flash | Günstiger |
|---|---|---|---|
| Support-Antwort3,000 Eingabe-Token, 400 Ausgabe-Token. | $0.65 | $0.64 | Qwen3.8 Flash, 2% günstiger |
| Dokumentenzusammenfassung25,000 Eingabe-Token, 1,000 Ausgabe-Token. | $4.25 | $4.22 | Gleich teuer |
| Agentenaufgabe80,000 Eingabe-Token (davon 70,000 aus dem Cache), 3,000 Ausgabe-Token. | $5.10 | $13.41 | GLM-5.3-Flash, 62% günstiger |
Die Tokenzahlen stammen von uns und sind so gewählt, dass sie realistischen Aufgaben entsprechen. Die Preise stammen von den Anbietern. Wenn für ein Modell kein Cache-Preis veröffentlicht ist, wird der wiederholt verwendete Kontext der Agentenaufgabe zum vollen Eingabepreis berechnet.
Das Kleingedruckte
Was in den Grundpreisen nicht enthalten ist, laut den Seiten der Anbieter: Aufschläge, Rabatte, Aktionen und Cache-Preise.
- GLM-5.3-Flash
- Insgesamt 320B Parameter, davon 18B aktiv. Die Speicherung zwischengespeicherter Eingaben ist „zeitlich begrenzt kostenlos“. Z.ai bietet außerdem GLM-5.3-FlashX ($0.37 / $1.25) an; dieses Modell ist nicht enthalten. Offene Modellgewichte auf Hugging Face (zai-org/GLM-5.3-Flash). Preisseite von Z.ai
- Qwen3.8 Flash
- Internationale Bereitstellung, eine Preisstufe für bis zu 1M Eingabetoken. Cache-Rabatte wie bei Qwen3.8 Max. Das Kontextfenster stammt aus der höchsten Preisstufe (1M). Preisseite von Alibaba (Qwen)
Weitere Vergleiche
Alle direkten Vergleiche in der Liste, an denen GLM-5.3-Flash oder Qwen3.8 Flash beteiligt ist.
Nur ein Viertel des Listenpreises zahlen
Das AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet. Für $25 erhalten Sie Nutzung im Wert von $100. Auf der Guthabenseite stehen die abgedeckten Modelle. Fragen Sie vor dem Kauf nach, wenn Sie ein anderes Modell nutzen möchten.
Preise geprüft am 22. September 2026