Quanto costa far funzionare un agente AI
Un agente non fa una sola chiamata. Esegue più passaggi e, a ogni passaggio, il contesto che legge cresce. Imposta le caratteristiche del tuo carico di lavoro, scegli un modello e il calcolatore determina il costo dell’intera esecuzione, passaggio per passaggio, in base alle tariffe pubblicate dal fornitore.
Gratis e senza registrazione. I calcoli vengono eseguiti nel tuo browser, quindi nulla di ciò che inserisci viene inviato altrove.
$2 in input e $10 in output per milione di token, secondo il prezzo pubblicato da Anthropic e consultato il 22 Settembre 2026.
Una chiamata al modello per ciascuno: una ricerca, una lettura, una decisione, una scrittura. Massimo 40.
Le istruzioni, gli strumenti a disposizione e la richiesta stessa. Circa 750 parole ogni 1,000 token.
Ciò che il passaggio restituisce: la pagina letta, le righe recuperate, il risultato dello strumento chiamato.
Solo la risposta. Il ragionamento è nel campo successivo, perché viene fatturato alla stessa tariffa.
Fatturati alla tariffa di output. Lascia vuoto per usare 400, un valore ipotizzato; imposta 0 per un modello che non ragiona prima di rispondere.
Lascia vuoto per usare 70%, un valore ipotizzato. Il primo passaggio legge dati non ancora in cache, quindi non ne usa.
Lascia vuoto per usare 5%, un valore ipotizzato.
Quante volte viene eseguito l’intero flusso di lavoro: per ogni ticket, lead o documento.
- Token letti in 10 passaggi
- 107,500 token
- Di questi, serviti dalla cache (70%)
- 72,450 token
- Token scritti: risposta e ragionamento
- 9,000 token
- Una esecuzione, 5% dei passaggi ripetuti
- $0.1833
- 1,000 esecuzioni al mese
- $183
Prezzo di listino pubblicato da Anthropic, consultato il 22 Settembre 2026. Risultati dalla cache a $0.20 per milione. Non include hosting, strumenti chiamati dall’agente, embedding e registrazione dei log.
$183. Quanto costano al mese 1,000 esecuzioni di un agente da 10 passaggi su Claude Sonnet 5.
| Passaggio | Legge | Dalla cache | Scrive | Costo |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Dieci passaggi, un contesto che cresce a partire da 4,000 token, il 70% dei token letti servito dalla cache e il 5% dei passaggi ripetuto: su Claude Sonnet 5, questa esecuzione legge 107,500 token e costa $0.1833. Per 1,000 esecuzioni al mese, il costo è di $183. La tariffa batch pubblicata dal fornitore lo dimezza.
Come si calcola il risultato
Tutti i valori ipotizzati dal calcolatore sono indicati in questa pagina, così puoi verificare il risultato anche con carta e penna.
- I prezzi
- Le tariffe per i token di input, di output e letti dalla cache sono quelle pubblicate da ciascun fornitore. Sono tratte da data/models/2026-09/models.json, che riporta la pagina dei prezzi e la data di consultazione (22 settembre 2026). Trovi gli stessi dati nelle nostre pagine dedicate ai modelli. Nessuno dei prezzi indicati proviene da un rivenditore.
- I passaggi
- Il primo passaggio legge il contesto iniziale. Ogni passaggio successivo legge quanto ha letto il precedente, più i token aggiunti da quest’ultimo. I token di input fatturati per un’esecuzione sono quindi la somma di quelli letti in tutti i passaggi, non quelli di un solo prompt. La tabella mostra il dettaglio di ogni passaggio.
- La cache
- La quota che imposti viene servita alla tariffa del fornitore per i token letti dalla cache. Il primo passaggio legge tutto senza cache, quindi nessuno dei suoi token è nella cache. Se il fornitore non pubblica una tariffa per la cache, i token vengono fatturati alla tariffa piena di input e il risultato lo indica.
- Token di ragionamento e tentativi ripetuti
- I token di ragionamento vengono fatturati alla tariffa di output, quindi si sommano ai token della risposta in ogni passaggio. La percentuale di tentativi ripetuti indica la quota di passaggi che falliscono e vengono eseguiti di nuovo: il costo dell’esecuzione viene moltiplicato per uno più questa percentuale. Entrambi i valori predefiniti sono ipotesi.
- La tariffa batch
- Quando un fornitore pubblica uno sconto batch nelle note sui prezzi, il calcolatore lo propone e ne indica l’entità: 50% per Anthropic, OpenAI e Google, 20% per Grok 4.3 e nessuno sconto dove il fornitore non offre questa modalità.
- Cosa non è incluso
- Hosting, strumenti chiamati dall’agente, embedding, registrazione dei log e sovrapprezzi per contesti lunghi che, su alcuni modelli, si applicano oltre 200,000 o 272,000 token in una singola richiesta. Se ogni passaggio resta sotto quella soglia, si applica la tariffa base.
Le domande più frequenti su questo risultato
Calcola il costo in base al tuo flusso di lavoro
L’audit misura i passaggi, il contesto e il volume effettivi prima di avviare lo sviluppo. Così pianifichi i costi sulla base di dati misurati, non di ipotesi.