GLM-5.3-Flash vs Qwen3.8 Flash
Due nuovi modelli cinesi economici con prezzi che differiscono solo di pochi centesimi. I prezzi di listino di entrambi, tratti dai siti dei produttori, e quanto costano tre attività quotidiane con ciascuno.
Dollari USA, tariffa standard, fascia di contesto più breve. Costo per prova superata tratto dal benchmark AIGROW per le piccole imprese.
- GLM-5.3-Flash
- $0.831
- Attività superate
- 18 su 20
- Qwen3.8 Flash
- $1.09
- Attività superate
- 19 su 20
Benchmark AIGROW per le piccole imprese, tentativi falliti inclusi.
Nel benchmark AIGROW per le piccole imprese, GLM-5.3-Flash costa $0.831 per 1,000 risposte corrette e Qwen3.8 Flash $1.09. Hanno superato rispettivamente 18 e 19 attività su 20. Per milione di token, GLM-5.3-Flash costa $0.15 in input e $0.50 in output; Qwen3.8 Flash costa $0.15 in input e $0.47 in output.
Fianco a fianco
La tariffa pubblicata da ciascun produttore per la fascia standard. L’input dalla cache è il costo di un prefisso del prompt ripetuto dopo che il fornitore lo ha memorizzato.
| Dato di fatto | GLM-5.3-Flash | Qwen3.8 Flash |
|---|---|---|
| Produttore | Z.ai | Alibaba (Qwen) |
| Fascia | Piccoli e veloci | Piccoli e veloci |
| Input, per milione di token | $0.15 | $0.15 |
| Output, per milione di token | $0.50 | $0.47 |
| Input dalla cache | $0.03 | Non pubblicato |
| Finestra di contesto | 1M | 1M |
| Data di rilascio | 26 ago 2026 | Non pubblicato |
| Pesi | Apri | Chiuse |
Quanto costa un’attività con ciascuno
1,000 esecuzioni di ogni attività ai due prezzi di listino. La differenza varia da un’attività all’altra perché i modelli applicano prezzi diversi a input, output e contesto dalla cache.
| Attività | GLM-5.3-Flash | Qwen3.8 Flash | Più economico |
|---|---|---|---|
| Risposta dell’assistenza3,000 in input, 400 in output. | $0.65 | $0.64 | Qwen3.8 Flash, 2% in meno |
| Riassunto di un documento25,000 in input, 1,000 in output. | $4.25 | $4.22 | Parità |
| Attività svolta da un agente80,000 in input (70,000 dalla cache), 3,000 in output. | $5.10 | $13.41 | GLM-5.3-Flash, 62% in meno |
Le quantità di token le abbiamo scelte noi per rappresentare attività realistiche; i prezzi sono quelli dei produttori. Se un modello non ha un prezzo pubblicato per la cache, il contesto riutilizzato dall’agente viene fatturato alla tariffa piena dei token in input.
I dettagli
Cosa non include ciascuna tariffa base, secondo le pagine dei produttori: supplementi, sconti, promozioni e prezzi della cache.
- GLM-5.3-Flash
- 320B parametri totali, 18B attivi. L’archiviazione dell’input nella cache è «Gratis per un periodo limitato». Z.ai vende anche GLM-5.3-FlashX ($0.37 / $1.25), qui non incluso. Pesi aperti su Hugging Face (zai-org/GLM-5.3-Flash). La pagina dei prezzi di Z.ai
- Qwen3.8 Flash
- Deployment internazionale, con un’unica fascia fino a 1M token in input. Sconti sulla cache come per Qwen3.8 Max. Finestra di contesto ricavata dalla fascia di prezzo più alta (1M). La pagina dei prezzi di Alibaba (Qwen)
Altri confronti
Tutti i confronti diretti dell’elenco che includono GLM-5.3-Flash o Qwen3.8 Flash.
Paga un quarto del prezzo di listino
Il credito API AIGROW viene scalato ai prezzi di listino dei produttori: con $25 ottieni $100 di utilizzo. La pagina del credito elenca i modelli coperti; chiedi informazioni sugli altri prima di acquistare.
Prezzi verificati il 22 settembre 2026