Gemma 4 31B : poids en accès libre, sans tarif public
Google publie les poids de Gemma 4 31B, mais ne propose pas d’API pour ce modèle. Il n’existe donc aucun prix catalogue sur lequel fonder un calcul. Retrouvez ci-dessous les informations disponibles, aux côtés des modèles auxquels il est comparé.
Dollars américains par million de tokens, tarif standard, tranche de contexte la plus courte.
- Fenêtre de contexte
- 256 000 tokens
- Date de sortie
- 2 avr. 2026
- Poids
- Ouvrir
D’après les pages de Google, le 22 septembre 2026.
Gemma 4 31B est un modèle à poids ouverts de Google, qui ne le propose pas sur sa propre API payante. Il n’a donc pas de prix catalogue : son coût dépend de l’hébergeur qui l’exécute ou de votre propre matériel. Il peut traiter jusqu’à 256 000 tokens à la fois et est sorti le 2 avr. 2026.
Gemma 4 31B face aux tâches réelles d’une petite entreprise
Ce que le benchmark AIGROW a mesuré en soumettant 20 tâches de bureau à Gemma 4 31B, chacune évaluée comme réussie ou échouée selon des critères fixes.
- Taux de réussite
- 60% des 20 exécutions ont réussi (intervalle à 95 % : 39 à 78 %), 27e sur 36 modèles.
- Coût pour 1 000 tâches réussies
- $0.558, exécutions échouées comprises.
- Temps de réponse
- Médiane de 11 s, 36 s au 90e percentile.
- Meilleur et moins bon résultat
- Tri des e-mails (100% de réussite) et Réponses aux avis (0%).
Les détails tarifaires
Ce que le tarif de base ci-dessus ne comprend pas, d’après les pages de l’éditeur : majorations, remises, promotions et tarifs de cache.
Pas de tarif payant direct : la page tarifaire de l’API Gemini ne propose Gemma 4 qu’en version gratuite ; l’offre payante y est indiquée comme « Non disponible ». Poids ouverts ; le coût dépend de l’hébergeur tiers. Fenêtre de contexte : https://ai.google.dev/gemma/docs/core/model_card_4 (256K tokens).
Gemma 4 31B face aux modèles auxquels il est comparé
Chaque comparatif présente les deux prix catalogue côte à côte et calcule le coût des trois mêmes tâches pour chaque modèle.
- face à Ministral 3 14B
- De petits modèles à poids ouverts que les entreprises envisagent d’héberger elles-mêmes.
- face à Muse Glimmer 30B
- Deux modèles à poids ouverts d’environ 30B paramètres, conçus pour les GPU grand public et les stations de travail.
- face à Qwen3.8 27B
- Des modèles à poids ouverts de taille intermédiaire que les entreprises envisagent de déployer dans leur propre infrastructure, dont un seul dispose d’un tarif d’API proposé directement par son éditeur.
Autres modèles de Google
| Modèle | Entrée | Sortie | Contexte | 1,000 réponses |
|---|---|---|---|---|
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
Source du prix
Tarifs consultés le 22 septembre 2026. Chaque prix correspond au tarif standard pour la tranche de contexte la plus courte, sans remise pour traitement par lots ou priorité ; les majorations pour contexte long, les tarifs de traitement par lots et les promotions figurent dans les détails tarifaires de chaque modèle. Aucun prix ne provient d’un revendeur.
Payez le quart du tarif public
Le crédit API AIGROW se décompte aux prix catalogue des éditeurs : $25 donnent droit à $100 d’utilisation. La page du crédit indique les modèles couverts ; renseignez-vous sur tout autre modèle avant d’acheter.
Tarifs vérifiés le 22 septembre 2026