Hva det koster å kjøre en KI-agent
En agent gjør mer enn ett API-kall. Den går gjennom flere trinn, og konteksten den leser, vokser for hvert trinn. Angi hvordan arbeidsmengden din ser ut, velg en modell, og kalkulatoren beregner prisen for hele kjøringen, trinn for trinn, med leverandørens publiserte priser.
Gratis og uten registrering. Beregningen skjer i nettleseren din, så ingenting av det du skriver, sendes noe sted.
$2 inn og $10 ut per million tokens, til prisen Anthropic oppgir, sjekket 22 September 2026.
Ett modellkall per trinn: et søk, en gjennomlesning, en beslutning eller en skriveoppgave. Maksimalt 40.
Instruksjonene, verktøyene den får tilgang til, og selve forespørselen. Omtrent 750 ord per 1,000 tokens.
Det trinnet henter inn: siden det leste, radene det hentet, eller resultatet fra verktøyet det brukte.
Bare svaret. Resonnering står i neste felt, fordi det faktureres til samme pris.
Faktureres til prisen for utdata. La feltet stå tomt for å bruke 400, en antakelse. Sett det til 0 for en modell som ikke resonnerer først.
La feltet stå tomt for å bruke 70%, en antakelse. Det første trinnet leses uten hurtigbuffer, så ingenting av det er bufret.
La feltet stå tomt for å bruke 5%, en antakelse.
Hvor ofte hele arbeidsflyten kjøres: per henvendelse, per lead eller per dokument.
- Lest over 10 trinn
- 107,500 tokens
- Av dette, hentet fra hurtigbuffer (70%)
- 72,450 tokens
- Skrevet: svaret og resonneringen
- 9,000 tokens
- Én kjøring, 5% av trinnene kjørt på nytt
- $0.1833
- 1,000 kjøringer per måned
- $183
Listeprisen Anthropic oppgir, sjekket 22 September 2026. Treff i hurtigbufferen til $0.20 per million. Hosting, verktøyene agenten bruker, embeddings og logging er ikke inkludert.
$183. Hva 1,000 kjøringer av en agent med 10 trinn koster per måned på Claude Sonnet 5.
| Trinn | Leser | Fra hurtigbuffer | Skriver | Kostnad |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Ti trinn, en kontekst som starter på 4,000 tokens, 70% av det som leses, hentet fra hurtigbufferen, og 5% av trinnene kjørt på nytt: På Claude Sonnet 5 leser denne kjøringen 107,500 tokens og koster $0.1833. Dermed koster 1,000 kjøringer i måneden $183. Leverandørens publiserte batchpris halverer dette.
Slik beregnes tallet
Alle tallene kalkulatoren legger til grunn, står på denne siden, så du kan kontrollregne resultatet selv.
- Prisene
- Prisene for input, output og treff i hurtigbufferen er hentet fra data/models/2026-09/models.json, slik hver leverandør har publisert dem. Filen oppgir prissiden og datoen den ble lest (22. september 2026). De samme prisene finnes på modellsidene våre. Ingen av prisene her kommer fra en forhandler.
- Trinnene
- Det første trinnet leser startkonteksten. Hvert trinn etter det leser det forrige trinnet leste, pluss tokenene det la til. Derfor faktureres summen av det som leses i alle trinnene, ikke bare én forespørsel. Tabellen viser beregningen for hvert trinn.
- Hurtigbufferen
- Andelen du angir, prises etter leverandørens sats for treff i hurtigbufferen. Det første trinnet leses uten hurtigbuffer, så ingenting derfra er bufret. Der leverandøren ikke publiserer en pris for hurtigbufrede tokens, faktureres de til full inputpris, og resultatet opplyser om det.
- Resonnering og nye forsøk
- Resonneringstokens faktureres til outputprisen og legges derfor til svaret i hvert trinn. Andelen nye forsøk angir hvor mange trinn som feiler og kjøres på nytt. Kostnaden for kjøringen ganges med én pluss denne andelen. Begge standardverdiene er antakelser.
- Batchprisen
- Når en leverandør oppgir batchrabatt i prisinformasjonen, tilbyr kalkulatoren den og viser rabatten: halv pris hos Anthropic, OpenAI og Google, en femtedel avslag på Grok 4.3 og ingen rabatt der leverandøren ikke tilbyr batchbehandling.
- Dette er ikke inkludert
- Hosting, verktøy agenten kaller, embeddings, logging og pristillegg for lang kontekst som på enkelte modeller gjelder når én forespørsel overstiger 200,000 eller 272,000 tokens. Holder du hvert trinn under denne grensen, gjelder grunnprisen.
Få beregnet prisen for din egen arbeidsflyt
Revisjonen måler de faktiske trinnene, konteksten og volumet før noe bygges. Dermed bygger du planene dine på målinger, ikke antakelser.