Gemini 3.1 Flash-Lite: quanto custa utilizar
O preço anunciado pela Google para Gemini 3.1 Flash-Lite, quanto custam uma resposta de suporte, um resumo de documento e uma tarefa de agente, e a sua posição entre 37 modelos.
Dólares americanos por milhão de tokens, tarifa padrão, faixa de contexto mais curta.
- 1,000 respostas de suporte
- $1.35
- Entrada em cache
- $0.025
- Janela de contexto
- 1.048.576 tokens
- Lançamento
- 7 de mai. de 2026
- Pesos
- Fechados
Segundo as páginas da Google, 22 de setembro de 2026.
Na API da Google, Gemini 3.1 Flash-Lite custa $0.25 por milhão de tokens de entrada, $1.50 por milhão de tokens de saída e $0.025 por milhão de tokens de entrada em cache. A esses preços, 1,000 respostas de suporte custam $1.35, o 7º mais barato entre 33 modelos com preço publicado na nossa lista.
O custo de uma tarefa
Três tarefas, 1,000 execuções de cada uma, ao preço de tabela acima, e a posição de Gemini 3.1 Flash-Lite entre os 33 modelos com preço de tabela em cada tarefa.
| Tarefa | 1,000 execuções | Entre 33 |
|---|---|---|
| Resposta de suporte3,000 de entrada, 400 de saída. | $1.35 | 7º mais barato |
| Resumo de documento25,000 de entrada, 1,000 de saída. | $7.75 | 7º mais barato |
| Tarefa de agente80,000 de entrada (70,000 em cache), 3,000 de saída. | $8.75 | 5º mais barato |
As quantidades de tokens foram definidas por nós para representar trabalho real; os preços são da Google. As três tarefas usam menos de 200,000 tokens por pedido, abaixo do limite de todas as sobretaxas por contexto longo da lista.
Gemini 3.1 Flash-Lite em tarefas reais de pequenas empresas
O que o benchmark da AIGROW mediu ao atribuir a Gemini 3.1 Flash-Lite 20 tarefas de escritório, cada uma avaliada como aprovada ou reprovada por critérios fixos.
- Taxa de sucesso
- 45% de 20 execuções passaram (intervalo de 95%: 26 a 66%), 28º entre 36 modelos.
- Custo por 1.000 aprovações
- $1.41, incluindo as execuções que falharam.
- Tempo de resposta
- Mediana de 1.7 s, 3.2 s no percentil 90.
- Melhor e pior desempenho
- Triagem de emails (100% passaram) e Respostas a avaliações (0%).
Os detalhes
O que a tarifa-base acima não inclui, conforme as páginas do fornecedor: sobretaxas, descontos, promoções e preços de cache.
A entrada de áudio custa $0.50 (em cache $0.05). Batch tem 50% de desconto. O armazenamento em cache custa $1.00 por MTok por hora.
Gemini 3.1 Flash-Lite frente aos modelos com que é comparado
Cada comparação mostra os dois preços de tabela lado a lado e calcula o custo das mesmas três tarefas em cada modelo.
- vs GPT-5.6 Luna
- O modelo nano da OpenAI frente ao Gemini mais barato da Google, com preços semelhantes.
- vs Gemini 3.5 Flash-Lite
- As duas gerações de Flash-Lite da Google, sendo a mais recente mais cara na saída.
Outros modelos da Google
| Modelo | Entrada | Saída | Contexto | 1,000 respostas |
|---|---|---|---|---|
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Gemma 4 31BGoogle · pesos abertos | Sem preço de tabela | · | 256K | · |
Origem do preço
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Pague um quarto do preço de tabela
O crédito de API da AIGROW é cobrado com base nos preços de tabela dos fornecedores, e $25 dão direito a $100 de utilização. A página do crédito indica os modelos incluídos; consulte-nos sobre qualquer outro antes de comprar.
Preços verificados em 22 de setembro de 2026