Was der Betrieb eines KI-Agenten kostet
Ein Agent besteht nicht aus einer einzigen Anfrage. Er durchläuft mehrere Schritte, und der Kontext, den er liest, wächst mit jedem Schritt. Legen Sie Ihr Arbeitspensum fest und wählen Sie ein Modell. Der Rechner ermittelt dann die Kosten für den gesamten Durchlauf, Schritt für Schritt zu den veröffentlichten Preisen des Anbieters.
Kostenlos und ohne Anmeldung. Die Berechnung läuft in Ihrem Browser. Nichts, was Sie eingeben, wird irgendwohin gesendet.
$2 für Input und $10 für Output pro Million Token, laut veröffentlichtem Preis von Anthropic, abgerufen am 22 September 2026.
Jeweils ein Modellaufruf: eine Suche, ein Lesevorgang, eine Entscheidung oder ein Schreibvorgang. Auf 40 begrenzt.
Die Anweisungen, die bereitgestellten Tools und die Anfrage selbst. 1,000 Token entsprechen ungefähr 750 Wörtern.
Was der Schritt zurückliefert: die gelesene Seite, die abgerufenen Datensätze oder das Ergebnis des aufgerufenen Tools.
Nur die Antwort. Die Token für den Denkprozess stehen im nächsten Feld, da sie zum gleichen Preis abgerechnet werden.
Werden zum Output-Preis abgerechnet. Leer lassen, um 400 als angenommenen Wert zu verwenden. Bei einem Modell ohne vorgelagerten Denkprozess 0 eingeben.
Leer lassen, um 70% als angenommenen Wert zu verwenden. Der erste Schritt liest ohne Cache, daher wird dabei nichts aus dem Cache bedient.
Leer lassen, um 5% als angenommenen Wert zu verwenden.
Wie oft der gesamte Workflow läuft: pro Ticket, pro Lead oder pro Dokument.
- Gelesene Token über 10 Schritte
- 107,500 Token
- Davon aus dem Cache bedient (70%)
- 72,450 Token
- Geschrieben: Antwort und Denkprozess
- 9,000 Token
- Ein Durchlauf, 5% der Schritte erneut ausgeführt
- $0.1833
- 1,000 Durchläufe pro Monat
- $183
Veröffentlichter Listenpreis von Anthropic, abgerufen am 22 September 2026. Cache-Treffer kosten $0.20 pro Million. Hosting, vom Agenten aufgerufene Tools, Embeddings und Protokollierung sind nicht enthalten.
$183. Monatliche Kosten für 1,000 Durchläufe eines Agenten mit 10 Schritten auf Claude Sonnet 5.
| Schritt | Gelesen | Aus dem Cache | Geschrieben | Kosten |
|---|---|---|---|---|
| 1 | 4,000 | 0 | 900 | $0.0170 |
| 2 | 5,500 | 3,850 | 900 | $0.0131 |
| 3 | 7,000 | 4,900 | 900 | $0.0142 |
| 4 | 8,500 | 5,950 | 900 | $0.0153 |
| 5 | 10,000 | 7,000 | 900 | $0.0164 |
| 6 | 11,500 | 8,050 | 900 | $0.0175 |
| 7 | 13,000 | 9,100 | 900 | $0.0186 |
| 8 | 14,500 | 10,150 | 900 | $0.0197 |
| 9 | 16,000 | 11,200 | 900 | $0.0208 |
| 10 | 17,500 | 12,250 | 900 | $0.0219 |
Zehn Schritte, ein Kontext, der von 4,000 Tokens aus wächst, 70% jedes Lesevorgangs aus dem Cache und 5% wiederholte Schritte: Auf Claude Sonnet 5 liest dieser Durchlauf 107,500 Tokens und kostet $0.1833. Bei 1,000 Durchläufen im Monat sind das $183. Der veröffentlichte Batch-Preis halbiert diese Kosten.
So wird das Ergebnis berechnet
Alle Annahmen des Rechners stehen auf dieser Seite. So können Sie das Ergebnis selbst nachrechnen.
- Die Preise
- Die von den jeweiligen Anbietern veröffentlichten Preise für Input, Output und Cache-Treffer stammen aus data/models/2026-09/models.json. Dort sind auch die Preisseite und das Abrufdatum (22. September 2026) dokumentiert. Dieselben Zahlen finden Sie auf unseren Modellseiten. Keiner der hier verwendeten Preise stammt von einem Wiederverkäufer.
- Die Schritte
- Der erste Schritt liest den Ausgangskontext. Jeder weitere Schritt liest den Kontext des vorherigen Schritts samt der dort hinzugefügten Tokens. Der abgerechnete Input eines Durchlaufs ist also die Summe aller Schritte, nicht nur eine einzelne Anfrage. Die Tabelle zeigt die Werte für jeden Schritt.
- Der Cache
- Der von Ihnen festgelegte Anteil wird zum Cache-Trefferpreis des Anbieters abgerechnet. Der erste Schritt liest den Kontext erstmals ein, daher kommt dabei nichts aus dem Cache. Veröffentlicht ein Anbieter keinen Cache-Preis, werden auch gecachte Tokens zum vollen Input-Preis abgerechnet. Das Ergebnis weist darauf hin.
- Reasoning und Wiederholungen
- Reasoning-Tokens werden zum Output-Preis abgerechnet und deshalb bei jedem Schritt zur Antwort hinzugerechnet. Die Wiederholungsrate gibt den Anteil der Schritte an, die fehlschlagen und erneut ausgeführt werden. Sie erhöht die Kosten eines Durchlaufs um diesen Anteil. Beide Standardwerte sind Annahmen.
- Der Batch-Preis
- Wenn ein Anbieter in seinen Preisangaben einen Batch-Rabatt veröffentlicht, bietet der Rechner ihn an und zeigt dessen Höhe: die Hälfte bei Anthropic, OpenAI und Google, ein Fünftel bei Grok 4.3 und keinen Rabatt, wenn der Anbieter keinen Batch-Tarif anbietet.
- Was nicht berücksichtigt wird
- Hosting, vom Agenten aufgerufene Tools, Embeddings, Protokollierung und Aufschläge für lange Kontexte, die bei manchen Modellen ab mehr als 200,000 oder 272,000 Tokens in einer einzelnen Anfrage anfallen. Bleibt ein Schritt unter dieser Grenze, gilt der Grundpreis.
Kosten für Ihren eigenen Workflow ermitteln lassen
Das Audit misst die tatsächliche Zahl der Schritte, die tatsächliche Kontextgröße und das tatsächliche Volumen, bevor etwas entwickelt wird. So planen Sie mit gemessenen Werten statt mit Annahmen.