Preços da API de Gemini: 4 modelos, por token e por tarefa
O preço de tabela de cada modelo da Google incluído na nossa lista, retirado da página de preços da própria Google, ao lado do custo de uma resposta aprovada no benchmark da AIGROW para pequenas empresas e do custo de três tarefas do dia a dia em cada modelo.
Dólares americanos por milhão de tokens, à tarifa padrão. Sem preços de revendedores.
- Gemini 3.1 Pro (preview)
- $2 / $12
- Gemini 3.8 Flash
- $0.75 / $3.75
- Gemini 3.5 Flash-Lite
- $0.30 / $2.50
- Gemini 3.1 Flash-Lite
- $0.25 / $1.50
Preço de tabela de entrada / saída por milhão de tokens.
Os preços dos 4 modelos da Google na nossa lista vão de Gemini 3.1 Flash-Lite, a $0.25 de entrada e $1.50 de saída por milhão de tokens, até Gemini 3.1 Pro (preview), a $2 de entrada e $12 de saída. No benchmark da AIGROW para pequenas empresas, Gemini 3.1 Pro (preview) obteve o melhor resultado, com 19 de 20 tarefas aprovadas, a $29.67 por mil aprovações.
Por token e por execução bem-sucedida
O preço de tabela por milhão de tokens, quantas das 20 tarefas administrativas do benchmark cada modelo concluiu com sucesso e o custo de 1.000 respostas aprovadas, incluindo as execuções falhadas.
| Modelo | Entrada | Saída | Entrada em cache | Contexto | Tarefas concluídas com sucesso | 1.000 execuções bem-sucedidas |
|---|---|---|---|---|---|---|
| Gemini 3.1 Pro (preview)Modelos de topo | $2.00 | $12.00 | $0.20 | 1.05M | 19 de 20 | $29.67 |
| Gemini 3.8 FlashModelos para uso diário | $0.75 | $3.75 | $0.075 | 1.05M | 18 de 20 | $7.17 |
| Gemini 3.5 Flash-LitePequenos e rápidos | $0.30 | $2.50 | $0.03 | 1.05M | 7 de 20 | $2.47 |
| Gemini 3.1 Flash-LitePequenos e rápidos | $0.25 | $1.50 | $0.025 | 1.05M | 9 de 20 | $1.41 |
Gemma 4 31B tem pesos abertos e não tem preço de tabela: Google não disponibiliza uma API para esse modelo.
O custo de três tarefas do dia a dia
1,000 execuções de cada tarefa ao preço de tabela. As contagens de tokens são nossas; os preços são da Google.
| Modelo | 1,000 × resposta de suporte | 1,000 × resumo de documento | 1,000 × tarefa de agente |
|---|---|---|---|
| Gemini 3.1 Pro (preview) | $10.80 | $62.00 | $70.00 |
| Gemini 3.8 Flash | $3.75 | $22.50 | $24.00 |
| Gemini 3.5 Flash-Lite | $1.90 | $10.00 | $12.60 |
| Gemini 3.1 Flash-Lite | $1.35 | $7.75 | $8.75 |
- Resposta de suporte
- Um prompt de 3.000 tokens (o pedido de suporte, a conversa até ao momento e um excerto das políticas) e uma resposta de 400 tokens.
- Resumo de documento
- Um documento de 40 páginas com cerca de 25.000 tokens de entrada e um resumo de 1.000 tokens de saída.
- Tarefa de agente
- Dez passos que leem, no total, 80.000 tokens, dos quais 70.000 são contexto repetido de um passo para o seguinte e servido a partir da cache, e geram 3.000 tokens.
Os detalhes
O que as páginas de preços da Google acrescentam às tarifas principais.
- Gemini 3.1 Pro (preview)
- Modelo em pré-visualização, mas a Google não tem um 3.x Pro em disponibilidade geral e este é amplamente utilizado. Para prompts com mais de 200K tokens: $4 / $18, em cache $0.40. O armazenamento em cache custa $4.50 por MTok por hora. Batch tem 50% de desconto. Saída máxima de 65,536.
- Gemini 3.8 Flash
- Preço de lançamento até 2026-12-31; a partir de 2027-01-01, passa para $1.50 / $7.50, em cache $0.15. Batch e Flex têm 50% de desconto; Priority custa $1.35 / $6.75. O armazenamento em cache custa $0.50 por MTok por hora (subirá para $1.00).
- Gemini 3.5 Flash-Lite
- O mesmo preço para entradas de texto, imagem, vídeo e áudio. Batch tem 50% de desconto. O armazenamento em cache custa $1.00 por MTok por hora.
- Gemini 3.1 Flash-Lite
- A entrada de áudio custa $0.50 (em cache $0.05). Batch tem 50% de desconto. O armazenamento em cache custa $1.00 por MTok por hora.
Lado a lado
Comparações entre um modelo da Gemini e outro modelo, com os preços de ambos e o custo das três tarefas em cada um.
- GPT-6 Astra vs. Gemini 3.1 Pro (preview)
- Claude Fable 5.1 vs. Gemini 3.1 Pro (preview)
- Claude Opus 5 vs. Gemini 3.1 Pro (preview)
- GPT-5.6 Sol vs. Gemini 3.1 Pro (preview)
- Grok 4.7 vs. Gemini 3.1 Pro (preview)
- Claude Sonnet 5 vs. Gemini 3.8 Flash
- GPT-5.6 Terra vs. Gemini 3.8 Flash
- Qwen3.7 Plus vs. Gemini 3.8 Flash
- Mistral Medium 3.5 vs. Gemini 3.8 Flash
- Grok 4.3 vs. Gemini 3.8 Flash
- GPT-5.6 Luna vs. Gemini 3.5 Flash-Lite
- GPT-5.6 Luna vs. Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 vs. Gemini 3.8 Flash
- Gemini 3.5 Flash-Lite vs. Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash vs. Gemini 3.5 Flash-Lite
- Ministral 3 14B vs. Gemma 4 31B
- Gemma 4 31B vs. Muse Glimmer 30B
- Qwen3.8 27B vs. Gemma 4 31B
Origem dos preços
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O consumo do crédito de API da AIGROW é calculado com base nos preços de tabela dos fabricantes, como os apresentados acima, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos abrangidos.
Preços verificados em 22 de setembro de 2026