Gemini 3.5 Flash-Lite: quanto custa utilizar
O preço anunciado pela Google para Gemini 3.5 Flash-Lite, quanto custam uma resposta de suporte, um resumo de documento e uma tarefa de agente, e a sua posição entre 37 modelos.
Dólares americanos por milhão de tokens, tarifa padrão, faixa de contexto mais curta.
- 1,000 respostas de suporte
- $1.90
- Entrada em cache
- $0.03
- Janela de contexto
- 1.048.576 tokens
- Lançamento
- 21 de jul. de 2026
- Pesos
- Fechados
Segundo as páginas da Google, 22 de setembro de 2026.
Na API da Google, Gemini 3.5 Flash-Lite custa $0.30 por milhão de tokens de entrada, $2.50 por milhão de tokens de saída e $0.03 por milhão de tokens de entrada em cache. A esses preços, 1,000 respostas de suporte custam $1.90, o 11º mais barato entre 33 modelos com preço publicado na nossa lista.
O custo de uma tarefa
Três tarefas, 1,000 execuções de cada uma, ao preço de tabela acima, e a posição de Gemini 3.5 Flash-Lite entre os 33 modelos com preço de tabela em cada tarefa.
| Tarefa | 1,000 execuções | Entre 33 |
|---|---|---|
| Resposta de suporte3,000 de entrada, 400 de saída. | $1.90 | 11º mais barato |
| Resumo de documento25,000 de entrada, 1,000 de saída. | $10.00 | 10º mais barato |
| Tarefa de agente80,000 de entrada (70,000 em cache), 3,000 de saída. | $12.60 | 7º mais barato |
As quantidades de tokens foram definidas por nós para representar trabalho real; os preços são da Google. As três tarefas usam menos de 200,000 tokens por pedido, abaixo do limite de todas as sobretaxas por contexto longo da lista.
Gemini 3.5 Flash-Lite em tarefas reais de pequenas empresas
O que o benchmark da AIGROW mediu ao atribuir a Gemini 3.5 Flash-Lite 20 tarefas de escritório, cada uma avaliada como aprovada ou reprovada por critérios fixos.
- Taxa de sucesso
- 35% de 20 execuções passaram (intervalo de 95%: 18 a 57%), 32º entre 36 modelos.
- Custo por 1.000 aprovações
- $2.47, incluindo as execuções que falharam.
- Tempo de resposta
- Mediana de 1.2 s, 1.5 s no percentil 90.
- Melhor e pior desempenho
- Extração de dados de faturas (100% passaram) e Respostas a avaliações (0%).
Os detalhes
O que a tarifa-base acima não inclui, conforme as páginas do fornecedor: sobretaxas, descontos, promoções e preços de cache.
O mesmo preço para entradas de texto, imagem, vídeo e áudio. Batch tem 50% de desconto. O armazenamento em cache custa $1.00 por MTok por hora.
Gemini 3.5 Flash-Lite frente aos modelos com que é comparado
Cada comparação mostra os dois preços de tabela lado a lado e calcula o custo das mesmas três tarefas em cada modelo.
- vs GPT-5.6 Luna
- Os modelos económicos mais recentes da OpenAI e da Google, ambos destinados a tarefas de grande volume.
- vs Gemini 3.1 Flash-Lite
- As duas gerações de Flash-Lite da Google, sendo a mais recente mais cara na saída.
- vs DeepSeek V4.1 Flash
- Modelos económicos com contexto de 1M, comparados para tarefas que envolvem muitos documentos.
Outros modelos da Google
| Modelo | Entrada | Saída | Contexto | 1,000 respostas |
|---|---|---|---|---|
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Gemma 4 31BGoogle · pesos abertos | Sem preço de tabela | · | 256K | · |
Origem do preço
Consultado em 22 de setembro de 2026. Cada preço corresponde à tarifa padrão para a faixa de contexto mais curta, sem desconto por processamento em lote ou prioridade; as sobretaxas por contexto longo, as tarifas por lote e as promoções constam das condições de cada modelo. Nenhum preço foi obtido junto de revendedores.
Use Gemini 3.5 Flash-Lite por um quarto do seu preço de tabela
O crédito de API da AIGROW cobre Gemini 3.5 Flash-Lite e é cobrado com base no preço de tabela acima: $25 dão direito a $100 de utilização.
Preços verificados em 22 de setembro de 2026