Prezzi dell’API di GLM: 2 modelli, per token e per attività
I prezzi di listino di tutti i modelli Z.ai presenti nel nostro elenco, tratti dal sito di Z.ai, a confronto con il costo di una risposta corretta nel benchmark AIGROW per le piccole imprese e con il costo di tre attività quotidiane per ciascun modello.
Dollari USA per milione di token, alla tariffa standard. Nessun prezzo dei rivenditori.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Prezzi di listino di input e output per milione di token.
I prezzi dei 2 modelli di Z.ai nel nostro elenco vanno da GLM-5.3-Flash a $0.15 in input e $0.50 in output per milione di token fino a GLM-5.3 a $1.40 in input e $4.40 in output. Nel benchmark AIGROW per le piccole imprese, GLM-5.3-Flash ha condiviso il miglior risultato, con 18 attività superate su 20, al costo più basso: $0.831 per mille attività superate.
Per token e per prova superata
Il prezzo di listino per milione di token, seguito dal numero delle 20 attività d’ufficio del benchmark superate da ogni modello e dal costo di 1.000 risposte corrette, includendo i tentativi falliti.
| Modello | Input | Output | Input dalla cache | Contesto | Attività superate | 1.000 prove superate |
|---|---|---|---|---|---|---|
| GLM-5.3Modelli di punta | $1.40 | $4.40 | $0.26 | 1M | 18 su 20 | $7.02 |
| GLM-5.3-FlashPiccoli e veloci | $0.15 | $0.50 | $0.03 | 1M | 18 su 20 | $0.831 |
Quanto costano tre attività quotidiane
1,000 esecuzioni di ogni attività al prezzo di listino. Le quantità di token sono stimate da noi; i prezzi sono quelli di Z.ai.
| Modello | 1,000 × risposta dell’assistenza | 1,000 × riassunto di un documento | 1,000 × attività svolta da un agente |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Risposta dell’assistenza
- Un prompt di 3.000 token (la richiesta di assistenza, la conversazione fino a quel momento e un estratto delle linee guida) e una risposta di 400 token.
- Riassunto di un documento
- Un documento di 40 pagine, pari a circa 25.000 token in input, e un riassunto di 1.000 token in output.
- Attività svolta da un agente
- Dieci passaggi che leggono complessivamente 80.000 token, di cui 70.000 sono contesto ripetuto da un passaggio all’altro e recuperato dalla cache, e producono 3.000 token.
I dettagli
Le condizioni aggiuntive riportate nelle pagine dei prezzi di Z.ai.
- GLM-5.3
- L’archiviazione dell’input nella cache è «Gratis per un periodo limitato». Output massimo: 128K token. Pesi aperti su Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- 320B parametri totali, 18B attivi. L’archiviazione dell’input nella cache è «Gratis per un periodo limitato». Z.ai vende anche GLM-5.3-FlashX ($0.37 / $1.25), qui non incluso. Pesi aperti su Hugging Face (zai-org/GLM-5.3-Flash).
Confronto diretto
I confronti tra un modello GLM e altri modelli, con i prezzi di entrambi e il costo di tre attività per ciascuno.
Da dove provengono i prezzi
Consultati il 22 settembre 2026. Ogni prezzo è la tariffa standard per la fascia di contesto più breve, senza sconti per batch o priorità; supplementi per contesti lunghi, tariffe batch e promozioni sono riportati nei dettagli di ciascun modello. Nessun prezzo proviene da rivenditori.
Paga un quarto del prezzo di listino
Il Credito API AIGROW viene conteggiato ai prezzi di listino dei produttori, come quelli riportati sopra, e $25 acquistano $100 di utilizzo. La pagina del credito elenca i modelli inclusi.
Prezzi verificati il 22 settembre 2026