Vad det kostar att köra en AI-agent
En agent gör inte bara ett anrop. Den arbetar i flera steg, och kontexten den läser växer för varje steg. Ange hur din arbetsbelastning ser ut och välj en modell. Kalkylatorn räknar då ut kostnaden för hela körningen, steg för steg, utifrån leverantörens publicerade priser.
Gratis och utan registrering. Beräkningen görs i din webbläsare, så inget du skriver skickas någonstans.
$2 för indata och $10 för utdata per miljon tokens, enligt Anthropics publicerade priser, avlästa 22 september 2026.
Ett modellanrop per steg: söka, läsa, fatta beslut eller skriva. Högst 40.
Instruktionerna, verktygen som modellen får och själva förfrågan. Ungefär 750 ord per 1,000 tokens.
Det som steget hämtar tillbaka: sidan det läste, raderna det hämtade eller resultatet från verktyget det anropade.
Bara svaret. Resonemanget anges i nästa fält eftersom det debiteras till samma pris.
Debiteras till priset för utdata. Lämna tomt för att använda 400, ett antaget värde. Ange 0 för en modell som inte resonerar först.
Lämna tomt för att använda 70%, ett antaget värde. Det första steget läser utan cache, så inget av det är cachat.
Lämna tomt för att använda 5%, ett antaget värde.
Hur ofta hela arbetsflödet körs: per ärende, lead eller dokument.
- Inläst under 10 steg
- 107,500 tokens
- Varav hämtat från cache (70%)
- 72,450 tokens
- Skrivet: svaret och resonemanget
- 9,000 tokens
- En körning, 5% av stegen körs om
- $0.1833
- 1,000 körningar i månaden
- $183
Listpris enligt Anthropic, avläst 22 september 2026. Cacheträffar kostar $0.20 per miljon. Drift, verktygen som agenten anropar, embeddings och loggning ingår inte.
$183. Vad 1,000 körningar i månaden av en agent med 10 steg kostar med Claude Sonnet 5.
| Steg | Läser | Från cache | Skriver | Kostnad |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Tio steg, en kontext som börjar på 4,000 token, 70% av varje läsning från cache och 5% av stegen som körs om: på Claude Sonnet 5 läser en sådan körning 107,500 token och kostar $0.1833. Det blir $183 för 1,000 körningar i månaden. Leverantörens publicerade batchpris halverar kostnaden.
Så räknar vi ut beloppet
Alla antaganden bakom kalkylatorn finns på den här sidan, så du kan kontrollräkna resultatet själv.
- Priserna
- Priserna för inmatning, utmatning och cacheträffar är de som respektive leverantör publicerar. De hämtas från data/models/2026-09/models.json, där både prissidan och avläsningsdatumet (22 september 2026) finns angivna. Samma siffror finns på våra modellsidor. Inget av priserna här kommer från en återförsäljare.
- Stegen
- Det första steget läser startkontexten. Varje följande steg läser det föregående stegets kontext plus de token som lades till där. Den debiterade inmatningen för en körning är alltså summan för alla steg, inte en enda fråga. Tabellen visar varje steg för sig.
- Cachen
- Den andel du anger debiteras enligt leverantörens pris för cacheträffar. Det första steget läser utan cache, så inget av det är cachat. Om leverantören inte publicerar något cachepris debiteras cachade token till fullt inmatningspris, vilket också framgår av resultatet.
- Resonemang och omförsök
- Resonemangstoken debiteras till utmatningspriset och läggs därför till svaret i varje steg. Andelen omförsök anger hur stor del av stegen som misslyckas och körs igen. Den multiplicerar kostnaden för körningen med ett plus den angivna andelen. Båda standardvärdena är antaganden.
- Batchpriset
- Om leverantören anger en batchrabatt i sina prisvillkor kan du välja den i kalkylatorn, som också visar rabattens storlek: halva priset hos Anthropic, OpenAI och Google, en femtedel lägre pris för Grok 4.3 och ingen rabatt där leverantören inte erbjuder någon.
- Det som inte ingår
- Hosting, verktyg som agenten anropar, embeddings, loggning och tilläggsavgifter för lång kontext, som för vissa modeller börjar över 200,000 eller 272,000 token i en enskild begäran. Om du håller varje steg under den gränsen gäller grundpriset.
Få kostnaden beräknad för ditt eget arbetsflöde
Granskningen mäter de faktiska stegen, den faktiska kontexten och den faktiska volymen innan något byggs. Då bygger siffran du planerar efter på mätningar, inte antaganden.