Gemma 4 31B: open gewichten, geen lijstprijs
Google publiceert de gewichten van Gemma 4 31B, maar biedt er zelf geen API voor aan. Daarom is er geen catalogusprijs om mee te rekenen. Hieronder staat wat wel bekend is, naast de modellen waarmee het wordt vergeleken.
Amerikaanse dollars per miljoen tokens, standaardtarief, kortste contextbereik.
- Contextvenster
- 256.000 tokens
- Uitgebracht
- 2 apr 2026
- Gewichten
- Openen
Van de eigen pagina's van Google, 22 september 2026.
Gemma 4 31B is een model met open gewichten van Google. Die biedt er zelf geen betaalde API voor aan, dus er is geen catalogusprijs. De kosten hangen af van de aanbieder die het host, of van je eigen hardware. Het verwerkt maximaal 256.000 tokens tokens tegelijk en werd uitgebracht op 2 apr 2026.
Gemma 4 31B bij echte taken voor kleine bedrijven
Wat de AIGROW-benchmark mat toen Gemma 4 31B 20 kantoortaken kreeg, elk beoordeeld als geslaagd of mislukt aan de hand van vaste controles.
- Slagingspercentage
- 60% van 20 pogingen geslaagd (95%-interval: 39 tot 78%), plaats 27e van 36 modellen.
- Kosten per 1.000 geslaagde pogingen
- $0.558, inclusief mislukte pogingen.
- Antwoordtijd
- Mediaan 11 s, 90e percentiel 36 s.
- Sterkste en zwakste onderdeel
- E-mails beoordelen en indelen (100% geslaagd) en Reageren op beoordelingen (0%).
De kleine lettertjes
Wat het basistarief hierboven buiten beschouwing laat, overgenomen van de pagina's van de aanbieder: toeslagen, kortingen, aanbiedingen en cacheprijzen.
Geen betaald tarief van de aanbieder zelf: de prijspagina van de Gemini API vermeldt Gemma 4 alleen op het gratis niveau; bij het betaalde niveau staat 'Niet beschikbaar'. Open weights; de kosten hangen af van de externe aanbieder. Contextvenster volgens https://ai.google.dev/gemma/docs/core/model_card_4 (256K tokens).
Gemma 4 31B vergeleken met vergelijkbare modellen
Elke vergelijking zet beide catalogusprijzen naast elkaar en berekent wat dezelfde drie taken bij elk model kosten.
- tegen Ministral 3 14B
- Kleine open-weightmodellen die bedrijven overwegen zelf te hosten.
- tegen Muse Glimmer 30B
- Twee open-weightmodellen met ongeveer 30B parameters, bedoeld voor consumenten-GPU's en workstations.
- tegen Qwen3.8 27B
- Middelgrote open-weightmodellen die bedrijven overwegen privé te implementeren, waarvan er maar één een eigen API met een gepubliceerde prijs heeft.
Andere modellen van Google
| Model | Input | Output | Context | 1,000 antwoorden |
|---|---|---|---|---|
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
Herkomst van de prijs
Geraadpleegd op 22 september 2026. Elke prijs is het standaardtarief voor het kortste contextbereik, zonder batch- of prioriteitskorting. Toeslagen voor lange context, batchtarieven en aanbiedingen staan in de details bij elk model. Geen enkele prijs komt van een wederverkoper.
Betaal een kwart van de lijstprijs
AIGROW API-tegoed wordt verrekend tegen de catalogusprijzen van de aanbieders. Voor $25 krijg je $100 aan gebruik. Op de tegoedpagina staat voor welke modellen het geldt. Vraag naar andere modellen voordat je koopt.
Prijzen gecontroleerd op 22 september 2026