Gemma 4 31B: offene Modellgewichte, kein Listenpreis
Google veröffentlicht die Modellgewichte von Gemma 4 31B, bietet dafür aber keine eigene API an. Deshalb gibt es keinen Listenpreis als Berechnungsgrundlage. Die bekannten Daten stehen unten, neben den Modellen, mit denen es verglichen wird.
US-Dollar pro Million Token, Standardtarif, kürzeste Kontextstufe.
- Kontextfenster
- 256.000 Token
- Veröffentlicht
- 2. Apr. 2026
- Modellgewichte
- Öffnen
Aus den eigenen Veröffentlichungen von Google, Stand 22. September 2026.
Gemma 4 31B ist ein Modell mit offenen Gewichten von Google. Der Anbieter vertreibt es nicht über eine eigene kostenpflichtige API, daher gibt es keinen Listenpreis. Die Kosten hängen vom Hosting-Anbieter oder von Ihrer eigenen Hardware ab. Es verarbeitet bis zu 256.000 Token auf einmal und wurde am 2. Apr. 2026 veröffentlicht.
Gemma 4 31B bei realen Aufgaben kleiner Unternehmen
Was der AIGROW-Benchmark gemessen hat, als Gemma 4 31B 20 Büroaufgaben bearbeitete. Jede Aufgabe wurde anhand fester Kriterien als bestanden oder nicht bestanden bewertet.
- Erfolgsquote
- 60% von 20 Durchläufen bestanden (95-%-Intervall: 39 bis 78 %), Platz 27. von 36 Modellen.
- Kosten pro 1.000 bestandene Durchläufe
- $0.558, einschließlich der fehlgeschlagenen Durchläufe.
- Antwortzeit
- Median: 11 s, 90. Perzentil: 36 s.
- Stärkster und schwächster Bereich
- E-Mails sortieren (100% bestanden) und Auf Bewertungen antworten (0%).
Das Kleingedruckte
Was im obigen Grundpreis nicht enthalten ist, laut den Seiten des Anbieters: Aufschläge, Rabatte, Aktionen und Cache-Preise.
Kein Preis für die kostenpflichtige Nutzung direkt bei Google: Die Preisseite der Gemini API führt Gemma 4 nur im kostenlosen Tarif auf. Für den kostenpflichtigen Tarif steht dort „Nicht verfügbar“. Die Modellgewichte sind offen zugänglich; die Kosten hängen vom Drittanbieter ab. Kontextfenster laut https://ai.google.dev/gemma/docs/core/model_card_4 (256K Token).
Gemma 4 31B im Vergleich mit den anderen betrachteten Modellen
Jeder Vergleich stellt beide Listenpreise gegenüber und berechnet die Kosten für dieselben drei Aufgaben mit jedem Modell.
- gegen Ministral 3 14B
- Kleine Modelle mit offenen Gewichten, die Unternehmen für das Selbsthosting in Betracht ziehen.
- gegen Muse Glimmer 30B
- Zwei Modelle mit offenen Gewichten und rund 30B Parametern, ausgelegt für handelsübliche GPUs und Workstations.
- gegen Qwen3.8 27B
- Mittelgroße Modelle mit offenen Gewichten, die Unternehmen für den privaten Betrieb in Betracht ziehen. Nur eines davon hat einen API-Preis vom Entwickler selbst.
Weitere Modelle von Google
| Modell | Eingabe | Ausgabe | Kontext | 1,000 Antworten |
|---|---|---|---|---|
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
Quelle des Preises
Abgerufen am 22. September 2026. Jeder Preis gilt für den Standardtarif in der kürzesten Kontextstufe, ohne Batch- oder Priority-Rabatt. Aufschläge für langen Kontext, Batch-Tarife und Aktionen stehen im Kleingedruckten der jeweiligen Modellseite. Es wurden keine Preise von Wiederverkäufern übernommen.
Nur ein Viertel des Listenpreises zahlen
Das AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet. Für $25 erhalten Sie Nutzung im Wert von $100. Auf der Guthabenseite stehen die abgedeckten Modelle. Fragen Sie vor dem Kauf nach, wenn Sie ein anderes Modell nutzen möchten.
Preise geprüft am 22. September 2026