Google · API

Gemini 2.5 Flash Lite

O Gemini 2.5 Flash Lite, de Google, custa R$ 0,52 por milhão de tokens de entrada e R$ 2,07 por milhão de saída. Uma conversa de WhatsApp com 10 respostas sai por cerca de R$ 0,048.

  • Lê imagem
  • Lê áudio
  • Lê vídeo
  • Raciocina antes de responder
  • Usa ferramentas

Atualizado em 25/09/2026 · preço da página oficial de Google

R$ 0,52por 1 milhão de tokens de entradaUS$ 0,10 na página oficial1
saída, por 1 milhão
R$ 2,07
US$ 0,401
1 conversa no WhatsApp
R$ 0,048
10 respostas2
tokens de contexto
1,05 mi
documentação oficial3

Onde o Gemini 2.5 Flash Lite fica no preço

4 dos 94 modelos com preço oficial custam menos na entrada; 89 custam o mesmo ou mais.

Amazon Nova Micro (Amazon): R$ 0,18GPT-5-nano (OpenAI): R$ 0,26Amazon Nova Lite (Amazon): R$ 0,31Granite 4.0 H Small (IBM): R$ 0,33Gemini 2.5 Flash Lite (Google): R$ 0,52GPT-4.1-nano (OpenAI): R$ 0,52GPT-6-luna (OpenAI): R$ 0,52Ministral 3 (3B) (Mistral AI): R$ 0,52GPT-4o-mini (OpenAI): R$ 0,78Ministral 3 (8B) (Mistral AI): R$ 0,78Mistral Small 4 (Mistral AI): R$ 0,78GPT-5.4-nano (OpenAI): R$ 1,04GPT-5.6-luna (OpenAI): R$ 1,04Ministral 3 (14B) (Mistral AI): R$ 1,04Gemini 3.1 Flash Lite (Google): R$ 1,29GPT-5-mini (OpenAI): R$ 1,29Codestral (Mistral AI): R$ 1,55DeepSeek Flash (DeepSeek): R$ 1,55Gemini 2.5 Flash (Google): R$ 1,55Gemini 3.5 Flash Lite (Google): R$ 1,55MiniMax-M2 (MiniMax): R$ 1,55MiniMax-M2.1 (MiniMax): R$ 1,55MiniMax-M2.5 (MiniMax): R$ 1,55MiniMax-M2.7 (MiniMax): R$ 1,55MiniMax-M3 (MiniMax): R$ 1,55Amazon Nova 2 Lite (Amazon): R$ 1,71GPT-4.1-mini (OpenAI): R$ 2,07Gemini 3 Flash Preview (Google): R$ 2,59GPT-3.5-turbo (OpenAI): R$ 2,59GPT-3.5-turbo-0125 (OpenAI): R$ 2,59Mistral Large 3 (Mistral AI): R$ 2,59MiniMax-M2.1 highspeed (MiniMax): R$ 3,11MiniMax-M2.5 highspeed (MiniMax): R$ 3,11MiniMax-M2.7 highspeed (MiniMax): R$ 3,11Gemini 3.6 Flash (Google): R$ 3,88Gemini 3.7 Flash (Google): R$ 3,88Gemini 3.8 Flash (Google): R$ 3,88GPT-5.4-mini (OpenAI): R$ 3,88Amazon Nova Pro (Amazon): R$ 4,14Claude Haiku 4.5 (Anthropic): R$ 5,18GPT-3.5-turbo-1106 (OpenAI): R$ 5,18Grok Build 0.1 (xAI): R$ 5,18o3-mini (OpenAI): R$ 5,70o4-mini (OpenAI): R$ 5,70Gemini 2.5 Pro (Google): R$ 6,47GPT-5 (OpenAI): R$ 6,47GPT-5.1 (OpenAI): R$ 6,47Grok 4.20 0309 Non Reasoning (xAI): R$ 6,47Grok 4.20 0309 Reasoning (xAI): R$ 6,47Grok 4.20 Multi Agent 0309 (xAI): R$ 6,47Grok 4.3 (xAI): R$ 6,47Muse Spark 1.3 (Meta): R$ 6,47DeepSeek V4 Pro (DeepSeek): R$ 6,84Amazon Nova 2 Pro (Amazon): R$ 7,12Gemini 3.5 Flash (Google): R$ 7,77Mistral Medium 3.5 (Mistral AI): R$ 7,77GPT-5.2 (OpenAI): R$ 9,06Claude Sonnet 5 (Anthropic): R$ 10,36Gemini 3.1 Pro Preview (Google): R$ 10,36GPT-4.1 (OpenAI): R$ 10,36GPT-5.6-terra (OpenAI): R$ 10,36GPT-6-sol (OpenAI): R$ 10,36Grok 4.5 (xAI): R$ 10,36Grok 4.6 (xAI): R$ 10,36Grok 4.7 (xAI): R$ 10,36o3 (OpenAI): R$ 10,36Amazon Nova Premier (Amazon): R$ 12,95GPT-4o (OpenAI): R$ 12,95GPT-5.4 (OpenAI): R$ 12,95Claude Sonnet 4.5 (Anthropic): R$ 15,54Claude Sonnet 4.6 (Anthropic): R$ 15,54Claude Opus 5.5 (Anthropic): R$ 20,72GPT-5.6-sol (OpenAI): R$ 20,72Claude Opus 4.5 (Anthropic): R$ 25,90Claude Opus 4.6 (Anthropic): R$ 25,90Claude Opus 4.7 (Anthropic): R$ 25,90Claude Opus 4.8 (Anthropic): R$ 25,90Claude Opus 5 (Anthropic): R$ 25,90GPT-4o-2024-05-13 (OpenAI): R$ 25,90GPT-5.5 (OpenAI): R$ 25,90Claude Fable 5 (Anthropic): R$ 51,80Claude Fable 5.1 (Anthropic): R$ 51,80Claude Mythos 5 (Anthropic): R$ 51,80Claude Mythos 5.1 (Anthropic): R$ 51,80GPT-4-turbo-2024-04-09 (OpenAI): R$ 51,80GPT-6-astra (OpenAI): R$ 51,80GPT-5-pro (OpenAI): R$ 77,69o1 (OpenAI): R$ 77,69o3-pro (OpenAI): R$ 103,59GPT-5.2-pro (OpenAI): R$ 108,77GPT-4-0613 (OpenAI): R$ 155,39GPT-5.4-pro (OpenAI): R$ 155,39GPT-5.5-pro (OpenAI): R$ 155,39o1-pro (OpenAI): R$ 776,93R$ 1R$ 10R$ 100Gemini 2.5 Flash Lite: R$ 0,52
R$ 0,18o mais barato, Amazon Nova Micro
R$ 6,47a mediana dos 94
R$ 776,93o mais caro, o1-pro
Cada traço é um modelo com preço oficial; onde os traços se juntam, a cor fica mais forte. O traço preto é a mediana. Escala logarítmica: cada marca do eixo vale dez vezes a anterior. R$ por 1 milhão de tokens de entrada, pela PTAX de 24/09/2026.

Preço

Por 1 milhão de tokens.
Tipo de tokenR$US$1
Entrada o que o modelo lêR$ 0,52US$ 0,10
Saída o que o modelo escreveR$ 2,07US$ 0,40

Camada grátis na API: sim.

Histórico de preço: um registro até agora, de 25/09/2026. A curva aparece aqui no dia em que o preço mudar, sem curva inventada.

Quanto custa no WhatsApp

UsoCusto estimado
1 resposta do agenteR$ 0,0048
1 conversa (10 respostas)R$ 0,048
1.000 respostas por mêsR$ 4,77
10.000 respostas por mêsR$ 47,65

Premissa: cada resposta lê 8.000 tokens e escreve 300.2

Gemini 2.5 Flash Lite e os modelos de Google de preço parecido

R$ por 1 milhão de tokens de entrada. Os 9 mais próximos no preço, dos 11 de Google com preço oficial.

  1. Gemini 2.5 Flash LiteR$ 0,52
  2. Gemini 3.1 Flash LiteR$ 1,29
  3. Gemini 2.5 FlashR$ 1,55
  4. Gemini 3.5 Flash LiteR$ 1,55
  5. Gemini 3 Flash PreviewR$ 2,59
  6. Gemini 3.6 FlashR$ 3,88
  7. Gemini 3.7 FlashR$ 3,88
  8. Gemini 3.8 FlashR$ 3,88
  9. Gemini 2.5 ProR$ 6,47

Qualidade nos testes

O Gemini 2.5 Flash Lite não aparece no placar de texto da LMArena publicado em 13/09/2026, ou aparece com um nome que Certu não conseguiu ligar a este modelo com certeza.4

Ficha do Gemini 2.5 Flash Lite

Origem

EmpresaGoogle
TipoAPI
Nome na página de preçosgemini-2.5-flash-lite

Capacidade

Janela de contexto1.048.576 tokens3
Saída máxima65.536 tokens
O que lêtexto, imagem, áudio, vídeo e arquivo
O que geratexto
Raciocina antes de respondersim
Usa ferramentas (chamada de função)sim

Acesso

API da empresasim, com preço oficial
Camada grátis na APIsim
Pesos abertosnão

Outras contas grátis: quanto custa colocar IA no seu negócio, quanto custa o WhatsApp sem resposta e quanto custa contratar um atendente. Para quem programa: o blog técnico de IA.

Como Certu pode ajudar

Você não precisa escolher modelo, contar token nem montar servidor. Certu monta um agente de IA que responde seus clientes no WhatsApp pela API oficial da Meta, com o que o seu negócio sabe responder. O plano Start custa R$ 299 por mês e já vem com 1.600 respostas.

Fontes e método
  1. Fonte do preço: Google - Gemini Developer API pricing (documentacao oficial, camada paga Standard), lida em 25/09/2026. Nome do modelo na página: gemini-2.5-flash-lite. Como a página foi lida: Página de preços da API Gemini. O robots.txt de ai.google.dev libera tudo e os termos do Google só proíbem acesso automatizado contra o robots.txt. Preço de tabela da API, camada padrão, sem desconto de lote, cache ou contrato. Entrada é o que o modelo lê; saída é o que ele escreve. Cache é o preço da entrada que a empresa já guardou de uma pergunta anterior, quando a página informa. Real pela PTAX de venda do Banco Central de 24/09/2026: R$ 5,1795 por dólar.
  2. A conta da conversa: 10 respostas do agente, cada uma lendo 8.000 tokens de entrada (instruções, o que a empresa sabe e o histórico da conversa) e escrevendo 300 tokens de saída. É a base que Certu usa para estimar o custo por resposta. Não entra desconto de cache nem os tokens extras dos modelos que "pensam" antes de responder, então modelo que raciocina pode sair mais caro. Numa medição de Certu de 05/08/2026, com dois negócios reais no Gemini, o custo ficou entre R$ 72 e R$ 77 por 10 mil mensagens, abaixo desta estimativa.
  3. Janela de contexto: página oficial, lida em 25/09/2026 (a documentação oficial do modelo escreve "Input token limit 1,048,576"). O que lê e gera, saída máxima, raciocínio e ferramentas: documentação oficial de Google, lida à mão em 25/09/2026. Campo que a fonte oficial não traz fica fora da ficha e aparece na linha "Não informado na fonte oficial".
  4. Fonte: LMArena, placar de texto, conjunto de dados público no Hugging Face (licença CC BY 4.0), publicado em 13/09/2026, consultado em 25/09/2026. O que o número mede: Nota do placar de texto da LMArena, na versão com controle de estilo e na categoria geral: pessoas mandam a mesma pergunta para dois modelos sem saber quais são e votam na melhor resposta, e a LMArena transforma os votos numa nota. Quanto maior, mais vezes o modelo ganhou. A faixa de confiança é o intervalo que a própria LMArena publica para a nota. A posição é a do placar inteiro, que tem modelos fora deste catálogo. Como o nome foi casado: Mesma empresa e mesmo nome, sem contar ponto, espaço e hífen. Aceita também o nome com o nível de raciocínio no fim (high, medium, low, minimal) e o nome com data no fim quando a LMArena só conhece aquele modelo por uma data.