Wat het kost om een AI-agent te laten draaien
Een agent doet niet één aanroep. Hij doorloopt meerdere stappen en de context die hij leest groeit bij elke stap. Stel je werklast samen, kies een model en de calculator berekent de kosten van de hele run, stap voor stap, op basis van de gepubliceerde tarieven van de aanbieder.
Gratis en zonder registratie. De berekening gebeurt in je browser, dus niets wat je invult wordt ergens naartoe gestuurd.
$2 voor input en $10 voor output per miljoen tokens, volgens de door Anthropic gepubliceerde prijzen, geraadpleegd op 22 September 2026.
Eén modelaanroep per stap: zoeken, lezen, beslissen of schrijven. Maximaal 40.
De instructies, de beschikbare tools en de vraag zelf. Ongeveer 750 woorden per 1,000 tokens.
Wat de stap terugkrijgt: de gelezen pagina, de opgehaalde rijen of het resultaat van de aangeroepen tool.
Alleen het antwoord. Redeneertokens staan in het volgende veld, omdat daarvoor hetzelfde tarief geldt.
Gefactureerd tegen het outputtarief. Laat dit leeg voor 400, een aanname. Vul 0 in voor een model dat niet eerst redeneert.
Laat dit leeg om 70% te gebruiken, een aanname. De eerste stap leest zonder cache, dus daarvan komt niets uit de cache.
Laat dit leeg om 5% te gebruiken, een aanname.
Hoe vaak de hele workflow wordt uitgevoerd: per ticket, per lead, per document.
- Gelezen over 10 stappen
- 107,500 tokens
- Daarvan uit de cache (70%)
- 72,450 tokens
- Geschreven: het antwoord en de redeneerstappen
- 9,000 tokens
- Eén uitvoering, 5% van de stappen opnieuw uitgevoerd
- $0.1833
- 1,000 uitvoeringen per maand
- $183
Catalogusprijs zoals gepubliceerd door Anthropic, geraadpleegd op 22 September 2026. Cachetreffers kosten $0.20 per miljoen. Hosting, de tools die de agent aanroept, embeddings en logging zijn niet meegerekend.
$183. Wat 1,000 uitvoeringen van een agent met 10 stappen per maand kosten met Claude Sonnet 5.
| Stap | Gelezen | Uit cache | Geschreven | Kosten |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Tien stappen, een context die begint bij 4,000 tokens, 70% van elke leesstap uit de cache en 5% van de stappen opnieuw uitgevoerd: op Claude Sonnet 5 leest die run 107,500 tokens en kost hij $0.1833. Bij 1,000 runs per maand is dat $183. Het gepubliceerde batchtarief halveert die kosten.
Hoe het bedrag wordt berekend
Alle aannames van de calculator staan op deze pagina, zodat je de uitkomst zelf kunt narekenen.
- De tarieven
- Tarieven voor input, output en cachehits zoals elke aanbieder ze publiceert, afkomstig uit data/models/2026-09/models.json. Dat bestand vermeldt de prijspagina en de datum waarop die is geraadpleegd (22 september 2026). Dezelfde bedragen staan op onze modelpagina's. Geen enkel tarief hier komt van een wederverkoper.
- De stappen
- De eerste stap leest de begincontext. Elke volgende stap leest wat de vorige stap heeft gelezen, plus de tokens die daaraan zijn toegevoegd. De gefactureerde input voor een run is dus de som van alle stappen, niet één prompt. De tabel per stap toont elke regel.
- De cache
- Het aandeel dat je instelt, wordt tegen het cachehittarief van de aanbieder verwerkt. De eerste stap leest alles voor het eerst, dus daarvan komt niets uit de cache. Als een aanbieder geen cachetarief publiceert, worden gecachte tokens tegen het volledige inputtarief gefactureerd. Dat staat dan bij het resultaat.
- Redeneren en opnieuw uitgevoerde stappen
- Redeneertokens worden tegen het outputtarief gefactureerd en daarom bij het antwoord van elke stap opgeteld. Het percentage opnieuw uitgevoerde stappen geeft aan welk deel van de stappen mislukt en opnieuw wordt uitgevoerd: de kosten van de run worden vermenigvuldigd met één plus dat percentage. Beide standaardwaarden zijn aannames.
- Het batchtarief
- Als de aanbieder in zijn prijsinformatie een batchkorting publiceert, kun je die in de calculator kiezen en zie je hoe groot de korting is: de helft eraf bij Anthropic, OpenAI en Google, een vijfde eraf bij Grok 4.3 en geen korting als de aanbieder geen batchverwerking aanbiedt.
- Wat niet is meegerekend
- Hosting, tools die de agent aanroept, embeddings, logging en de toeslagen voor een lange context die bij sommige modellen gelden boven 200,000 of 272,000 tokens in één verzoek. Blijft een stap onder die grens, dan geldt het basistarief.
Veelgestelde vragen over dit bedrag
Laat de kosten berekenen voor je eigen workflow
De audit meet de werkelijke stappen, de werkelijke context en het werkelijke volume voordat er iets wordt gebouwd. Zo baseer je je planning op metingen in plaats van aannames.