GLM-5.3: quanto costa usarlo
Il prezzo di GLM-5.3 pubblicato da Z.ai, il costo di una risposta di assistenza, un riepilogo di documento e un’attività affidata a un agente, e la sua posizione tra 37 modelli.
Dollari USA per milione di token, tariffa standard, fascia di contesto più breve.
- 1,000 risposte dell’assistenza
- $5.96
- Input dalla cache
- $0.26
- Finestra di contesto
- 1.000.000 token
- Data di rilascio
- 18 ago 2026
- Pesi
- Apri
Dalle pagine di Z.ai, 22 settembre 2026.
Sull’API ufficiale di Z.ai, GLM-5.3 costa $1.40 per milione di token in input, $4.40 per milione di token in output e $0.26 per l’input dalla cache. A questi prezzi, 1,000 risposte di assistenza costano $5.96, posizione il il 14º più costoso tra 33 modelli con un prezzo di listino nel nostro elenco.
Quanto costa un’attività
Tre attività, 1,000 esecuzioni ciascuna, al prezzo di listino indicato sopra, con la posizione di GLM-5.3 tra i 33 modelli che hanno un prezzo di listino.
| Attività | 1,000 esecuzioni | Tra 33 |
|---|---|---|
| Risposta dell’assistenza3,000 in input, 400 in output. | $5.96 | il 14º più costoso |
| Riassunto di un documento25,000 in input, 1,000 in output. | $39.40 | il 14º più costoso |
| Attività svolta da un agente80,000 in input (70,000 dalla cache), 3,000 in output. | $45.40 | il 15º più costoso |
Le quantità di token le abbiamo scelte noi per rappresentare attività realistiche; i prezzi sono quelli di Z.ai. Tutte e tre le attività restano sotto i 200,000 token per richiesta, al di sotto della soglia di qualsiasi supplemento per contesti lunghi nell’elenco.
GLM-5.3 alle prese con attività reali di una piccola impresa
Cosa ha misurato il benchmark AIGROW assegnando a GLM-5.3 20 attività d’ufficio, ciascuna valutata come superata o fallita secondo criteri prestabiliti.
- Percentuale di successo
- 90% di 20 esecuzioni superate (intervallo al 95%: da 70 a 97%), posizione 4º su 36 modelli.
- Costo per 1,000 esecuzioni superate
- $7.02, incluse le esecuzioni fallite.
- Tempo di risposta
- Mediana 9.2 s, 90° percentile 31 s.
- Il risultato migliore e il peggiore
- Pianificazione degli appuntamenti (100% superate) e Risposte alle recensioni (0%).
I dettagli
Cosa non include la tariffa base indicata sopra, secondo le pagine del produttore: supplementi, sconti, promozioni e prezzi della cache.
L’archiviazione dell’input nella cache è «Gratis per un periodo limitato». Output massimo: 128K token. Pesi aperti su Hugging Face (zai-org/GLM-5.3).
GLM-5.3 a confronto con gli altri modelli valutati
Ogni confronto affianca i due prezzi di listino e calcola il costo delle stesse tre attività per entrambi i modelli.
- vs DeepSeek V4 Pro
- Modelli cinesi di frontiera a pesi aperti nella stessa fascia di prezzo.
- vs Kimi K3
- Modelli di frontiera a pesi aperti usciti a meno di due mesi di distanza, con Kimi che costa da due a tre volte di più.
Altri modelli di Z.ai
| Modello | Input | Output | Contesto | 1,000 risposte |
|---|---|---|---|---|
| GLM-5.3-FlashZ.ai · pesi aperti | $0.15 | $0.50 | 1M | $0.65 |
Da dove proviene il prezzo
Consultati il 22 settembre 2026. Ogni prezzo è la tariffa standard per la fascia di contesto più breve, senza sconti per batch o priorità; supplementi per contesti lunghi, tariffe batch e promozioni sono riportati nei dettagli di ciascun modello. Nessun prezzo proviene da rivenditori.
Paga un quarto del prezzo di listino
Il credito API AIGROW viene scalato ai prezzi di listino dei produttori: con $25 ottieni $100 di utilizzo. La pagina del credito elenca i modelli coperti; chiedi informazioni sugli altri prima di acquistare.
Prezzi verificati il 22 settembre 2026