Gemini API-Preise: 4 Modelle, Kosten pro Token und Aufgabe
Der Listenpreis jedes Google-Modells in unserer Übersicht, entnommen aus der Preisseite von Google, zusammen mit den Kosten für eine erfolgreiche Antwort im AIGROW Benchmark für kleine Unternehmen und für drei alltägliche Aufgaben pro Modell.
US-Dollar pro Million Tokens zum Standardtarif. Keine Reseller-Preise.
- Gemini 3.1 Pro (preview)
- $2 / $12
- Gemini 3.8 Flash
- $0.75 / $3.75
- Gemini 3.5 Flash-Lite
- $0.30 / $2.50
- Gemini 3.1 Flash-Lite
- $0.25 / $1.50
Listenpreis für Eingabe/Ausgabe pro Million Tokens.
Die 4 Modelle von Google auf unserer Liste reichen preislich von Gemini 3.1 Flash-Lite mit $0.25 Input-Token und $1.50 Output-Token pro Million Token bis Gemini 3.1 Pro (preview) mit $2 Input-Token und $12 Output-Token. Im AIGROW-Benchmark für kleine Unternehmen erzielte Gemini 3.1 Pro (preview) das beste Ergebnis: 19 von 20 Aufgaben bestanden, bei Kosten von $29.67 pro tausend bestandene Durchläufe.
Pro Token und erfolgreichem Durchlauf
Der Listenpreis pro Million Tokens, wie viele der 20 Büroaufgaben im Benchmark jedes Modell erfolgreich erledigt hat und was 1.000 erfolgreiche Antworten kosten, fehlgeschlagene Durchläufe eingeschlossen.
| Modell | Eingabe | Ausgabe | Zwischengespeicherte Eingabe | Kontext | Erfolgreich erledigte Aufgaben | 1.000 erfolgreiche Durchläufe |
|---|---|---|---|---|---|---|
| Gemini 3.1 Pro (preview)Flaggschiffmodelle | $2.00 | $12.00 | $0.20 | 1.05M | 19 von 20 | $29.67 |
| Gemini 3.8 FlashAllrounder | $0.75 | $3.75 | $0.075 | 1.05M | 18 von 20 | $7.17 |
| Gemini 3.5 Flash-LiteKlein und schnell | $0.30 | $2.50 | $0.03 | 1.05M | 7 von 20 | $2.47 |
| Gemini 3.1 Flash-LiteKlein und schnell | $0.25 | $1.50 | $0.025 | 1.05M | 9 von 20 | $1.41 |
Gemma 4 31B hat offene Modellgewichte und keinen Listenpreis: Google bietet dafür keine API an.
Kosten für drei alltägliche Aufgaben
Je 1,000 Durchläufe pro Aufgabe zum Listenpreis. Die Token-Mengen stammen von uns, die Preise von Google.
| Modell | 1,000 × Support-Antwort | 1,000 × Dokumentenzusammenfassung | 1,000 × Agentenaufgabe |
|---|---|---|---|
| Gemini 3.1 Pro (preview) | $10.80 | $62.00 | $70.00 |
| Gemini 3.8 Flash | $3.75 | $22.50 | $24.00 |
| Gemini 3.5 Flash-Lite | $1.90 | $10.00 | $12.60 |
| Gemini 3.1 Flash-Lite | $1.35 | $7.75 | $8.75 |
- Support-Antwort
- Eine Anfrage mit 3.000 Tokens (das Ticket, der bisherige Nachrichtenverlauf und ein Auszug aus den Richtlinien) und eine Antwort mit 400 Tokens.
- Dokumentenzusammenfassung
- Ein 40-seitiges Dokument mit etwa 25.000 Eingabe-Tokens und eine Zusammenfassung mit 1.000 Ausgabe-Tokens.
- Agentenaufgabe
- Zehn Schritte, die zusammen 80.000 Tokens lesen, davon 70.000 Tokens als von Schritt zu Schritt wiederholter Kontext aus dem Cache, und 3.000 Tokens schreiben.
Das Kleingedruckte
Was auf den Preisseiten von Google zusätzlich zu den Grundpreisen steht.
- Gemini 3.1 Pro (preview)
- Vorschaumodell, aber Google bietet noch kein allgemein verfügbares Pro-Modell der 3.x-Reihe an und es wird häufig genutzt. Prompts über 200K Token: $4 / $18, aus dem Cache $0.40. Cache-Speicherung: $4.50 pro Million Token und Stunde. Batch: 50% Rabatt. Maximal 65,536 Ausgabe-Token.
- Gemini 3.8 Flash
- Einführungspreis bis 2026-12-31; ab 2027-01-01 beträgt er $1.50 / $7.50, aus dem Cache $0.15. Batch und Flex: 50% Rabatt; Priority: $1.35 / $6.75. Cache-Speicherung: $0.50 pro Million Token und Stunde (steigt auf $1.00).
- Gemini 3.5 Flash-Lite
- Gleicher Preis für Text-, Bild-, Video- und Audioeingaben. Batch: 50% Rabatt. Cache-Speicherung: $1.00 pro Million Token und Stunde.
- Gemini 3.1 Flash-Lite
- Audioeingaben: $0.50 (aus dem Cache $0.05). Batch: 50% Rabatt. Cache-Speicherung: $1.00 pro Million Token und Stunde.
Direkter Vergleich
Vergleiche, bei denen auf einer Seite ein Modell von Gemini steht, jeweils mit den Preisen beider Modelle und den Kosten für drei Aufgaben.
- GPT-6 Astra vs. Gemini 3.1 Pro (preview)
- Claude Fable 5.1 vs. Gemini 3.1 Pro (preview)
- Claude Opus 5 vs. Gemini 3.1 Pro (preview)
- GPT-5.6 Sol vs. Gemini 3.1 Pro (preview)
- Grok 4.7 vs. Gemini 3.1 Pro (preview)
- Claude Sonnet 5 vs. Gemini 3.8 Flash
- GPT-5.6 Terra vs. Gemini 3.8 Flash
- Qwen3.7 Plus vs. Gemini 3.8 Flash
- Mistral Medium 3.5 vs. Gemini 3.8 Flash
- Grok 4.3 vs. Gemini 3.8 Flash
- GPT-5.6 Luna vs. Gemini 3.5 Flash-Lite
- GPT-5.6 Luna vs. Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 vs. Gemini 3.8 Flash
- Gemini 3.5 Flash-Lite vs. Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash vs. Gemini 3.5 Flash-Lite
- Ministral 3 14B vs. Gemma 4 31B
- Gemma 4 31B vs. Muse Glimmer 30B
- Qwen3.8 27B vs. Gemma 4 31B
Woher die Preise stammen
Abgerufen am 22. September 2026. Jeder Preis gilt für den Standardtarif in der kürzesten Kontextstufe, ohne Batch- oder Priority-Rabatt. Aufschläge für langen Kontext, Batch-Tarife und Aktionen stehen im Kleingedruckten der jeweiligen Modellseite. Es wurden keine Preise von Wiederverkäufern übernommen.
Nur ein Viertel des Listenpreises zahlen
AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet, wie oben gezeigt. Für $25 erhalten Sie ein Nutzungsguthaben von $100. Auf der Seite zum Guthaben stehen die abgedeckten Modelle.
Preise geprüft am 22. September 2026