Gemma 4 31B: pesos abertos, sem preço de tabela
A Google publica os pesos de Gemma 4 31B, mas não disponibiliza uma API própria para este modelo, por isso não há preço de tabela para calcular custos. Abaixo está o que se sabe sobre ele, ao lado dos modelos com que é comparado.
Dólares americanos por milhão de tokens, tarifa padrão, faixa de contexto mais curta.
- Janela de contexto
- 256.000 tokens
- Lançamento
- 2 de abr. de 2026
- Pesos
- Abrir
Segundo as páginas da Google, 22 de setembro de 2026.
Gemma 4 31B é um modelo de pesos abertos da Google, que não o disponibiliza numa API própria paga. Por isso, não tem preço de tabela: o custo depende de quem o aloja ou do seu próprio hardware. Consegue ler até 256.000 tokens de uma só vez e foi lançado em 2 de abr. de 2026.
Gemma 4 31B em tarefas reais de pequenas empresas
O que o benchmark da AIGROW mediu ao atribuir a Gemma 4 31B 20 tarefas de escritório, cada uma avaliada como aprovada ou reprovada por critérios fixos.
- Taxa de sucesso
- 60% de 20 execuções passaram (intervalo de 95%: 39 a 78%), 27º entre 36 modelos.
- Custo por 1.000 aprovações
- $0.558, incluindo as execuções que falharam.
- Tempo de resposta
- Mediana de 11 s, 36 s no percentil 90.
- Melhor e pior desempenho
- Triagem de emails (100% passaram) e Respostas a avaliações (0%).
Os detalhes
O que a tarifa-base acima não inclui, conforme as páginas do fornecedor: sobretaxas, descontos, promoções e preços de cache.
Sem preço pago direto da Google: a página de preços da Gemini API apresenta Gemma 4 apenas no nível gratuito; o nível pago consta como «Não disponível». Pesos abertos; o custo depende do fornecedor externo. Contexto indicado em https://ai.google.dev/gemma/docs/core/model_card_4 (256K tokens).
Gemma 4 31B frente aos modelos com que é comparado
Cada comparação mostra os dois preços de tabela lado a lado e calcula o custo das mesmas três tarefas em cada modelo.
- vs Ministral 3 14B
- Modelos pequenos com pesos abertos que as empresas consideram alojar na sua própria infraestrutura.
- vs Muse Glimmer 30B
- Dois modelos com pesos abertos, com cerca de 30B parâmetros, concebidos para GPUs de consumo e estações de trabalho.
- vs Qwen3.8 27B
- Modelos de tamanho médio com pesos abertos que as empresas consideram implementar em infraestrutura privada, sendo que apenas um tem um preço definido para a API própria.
Outros modelos da Google
| Modelo | Entrada | Saída | Contexto | 1,000 respostas |
|---|---|---|---|---|
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
Origem do preço
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O crédito de API da AIGROW é cobrado com base nos preços de tabela dos fornecedores, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos incluídos; consulte-nos sobre qualquer outro antes de comprar.
Preços verificados em 22 de setembro de 2026