Hvad det koster at køre en AI-agent
En agent foretager ikke kun ét kald. Den arbejder i flere trin, og den kontekst, den læser, vokser for hvert trin. Angiv din arbejdsbelastning, vælg en model, og beregneren viser prisen for hele kørslen trin for trin ud fra udbyderens offentliggjorte takster.
Gratis og uden tilmelding. Beregningen foregår i din browser, så intet af det, du skriver, bliver sendt nogen steder hen.
$2 for input og $10 for output pr. million tokens, ifølge Anthropics offentliggjorte priser, aflæst den 22 September 2026.
Ét modelkald pr. trin: søgning, læsning, beslutning eller skrivning. Højst 40.
Instruktionerne, de tilgængelige værktøjer og selve forespørgslen. Cirka 750 ord pr. 1,000 tokens.
Det, trinnet henter: siden, det læste, rækkerne, det hentede, eller resultatet fra det værktøj, det brugte.
Kun svaret. Tokens til ræsonnement angives i næste felt, fordi de afregnes til samme pris.
Afregnes til outputprisen. Lad feltet stå tomt for at bruge 400 som antagelse. Sæt det til 0 for en model, der ikke ræsonnerer først.
Lad feltet stå tomt for at bruge 70% som antagelse. Første trin er en læsning uden cache, så intet af det er cachelagret.
Lad feltet stå tomt for at bruge 5% som antagelse.
Hvor ofte hele arbejdsgangen køres: pr. supportsag, pr. lead eller pr. dokument.
- Læst på tværs af 10 trin
- 107,500 tokens
- Heraf leveret fra cache (70%)
- 72,450 tokens
- Skrevet: svaret og ræsonnementet
- 9,000 tokens
- Én kørsel, 5% af trinnene kørt igen
- $0.1833
- 1,000 kørsler om måneden
- $183
Listepris offentliggjort af Anthropic, aflæst den 22 September 2026. Cachehits til $0.20 pr. million. Hosting, de værktøjer, agenten bruger, embeddings og logning er ikke medregnet.
$183. Hvad 1,000 kørsler af en agent med 10 trin koster om måneden med Claude Sonnet 5.
| Trin | Læser | Fra cache | Skriver | Pris |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Ti trin, en kontekst, der vokser fra 4,000 tokens, 70% af hvert trin læst fra cache og 5% af trinnene kørt igen: På Claude Sonnet 5 læser kørslen 107,500 tokens og koster $0.1833. Det svarer til $183 for 1,000 kørsler om måneden. Den offentliggjorte batchpris halverer beløbet.
Sådan beregnes tallet
Alle tal, beregneren bygger på, står på denne side, så du kan efterprøve resultatet med papir og blyant.
- Priserne
- Priserne for input, output og cachehits er dem, hver udbyder selv offentliggør. De hentes fra data/models/2026-09/models.json, som angiver prissiden og datoen, den blev læst (22. september 2026). De samme priser findes på vores modelsider. Ingen af priserne her kommer fra en forhandler.
- Trinnene
- Første trin læser startkonteksten. Hvert efterfølgende trin læser det, det foregående trin læste, plus de tokens, trinnet tilføjede. Det fakturerede input for en kørsel er derfor summen af alle trin, ikke én enkelt forespørgsel. Tabellen viser hvert trin for sig.
- Cachen
- Den andel, du angiver, afregnes til udbyderens pris for cachehits. Første trin læses uden cache, så intet af det er cachelagret. Hvis en udbyder ikke offentliggør en cachepris, afregnes cachelagrede tokens til den fulde inputpris, og det fremgår af resultatet.
- Ræsonnement og gentagne forsøg
- Ræsonnementstokens afregnes til outputprisen og lægges derfor til svaret for hvert trin. Genkørselsraten er den andel af trinnene, der fejler og køres igen. Den ganges på kørslen som én plus raten. Begge standardværdier er antagelser.
- Batchprisen
- Når udbyderen angiver en batchrabat i sine prisnoter, kan du vælge den i beregneren, som også viser rabattens størrelse: halv pris hos Anthropic, OpenAI og Google, en femtedel i rabat på Grok 4.3 og ingen rabat, hvor udbyderen ikke tilbyder batchbehandling.
- Hvad beregningen ikke omfatter
- Hosting, værktøjer, som agenten kalder, embeddings, logning og tillæg for lange kontekster, som på nogle modeller gælder ved mere end 200,000 eller 272,000 tokens i én forespørgsel. Holder du hvert trin under den grænse, gælder basisprisen.
Få beregnet prisen for din egen arbejdsgang
Auditen måler de faktiske trin, den faktiske kontekst og det faktiske antal kørsler, før noget bygges. Så det tal, du planlægger ud fra, bygger på målinger frem for antagelser.