Comparador de modelos de IA lado a lado
Entre o1, Gemini 3.1 Flash Lite e GPT-4o-mini, o mais barato por conversa de WhatsApp é o GPT-4o-mini, a R$ 0,071, e o mais caro é o o1, a R$ 7,15. A diferença é de 100 vezes.
Lado a lado
| Modelo | OAo1 | GOGemini 3.1 Flash Lite | OAGPT-4o-mini |
|---|---|---|---|
| Preço | |||
| Entrada (por 1 milhão de tokens) | R$ 77,69 US$ 15,00 | R$ 1,29 US$ 0,25 | R$ 0,78 US$ 0,15 |
| Saída (por 1 milhão de tokens) | R$ 310,77 US$ 60,00 | R$ 7,77 US$ 1,50 | R$ 3,11 US$ 0,60 |
| Conversa de 10 respostas1 | R$ 7,15 | R$ 0,13 | R$ 0,071 |
| 1.000 respostas por mês | R$ 714,77 | R$ 12,69 | R$ 7,15 |
| Fonte do preço | página oficial 25/09/2026 | página oficial 25/09/2026 | página oficial 25/09/2026 |
| Capacidade | |||
| Janela de contexto | 200.000 tokens | 1.048.576 tokens | 128.000 tokens |
| O que lê | texto e imagem | texto, imagem, áudio, vídeo e arquivo | texto e imagem |
| O que gera | texto | texto | texto |
| Pesos abertos | não | não | não |
| Qualidade | |||
| Melhor posição na LMArena2 | 145º | sem dado | 251º |
| Nota na LMArena | 1.402,1 | sem dado | 1.317,6 |
Outras contas grátis: quanto custa colocar IA no seu negócio, quanto custa o WhatsApp sem resposta e quanto custa contratar um atendente. Para quem programa: o blog técnico de IA.
Como Certu pode ajudar
Você não precisa escolher modelo, contar token nem montar servidor. Certu monta um agente de IA que responde seus clientes no WhatsApp pela API oficial da Meta, com o que o seu negócio sabe responder. O plano Start custa R$ 299 por mês e já vem com 1.600 respostas.
Fontes e método
- A conta da conversa: 10 respostas do agente, cada uma lendo 8.000 tokens de entrada (instruções, o que a empresa sabe e o histórico da conversa) e escrevendo 300 tokens de saída. É a base que Certu usa para estimar o custo por resposta. Não entra desconto de cache nem os tokens extras dos modelos que "pensam" antes de responder, então modelo que raciocina pode sair mais caro. Numa medição de Certu de 05/08/2026, com dois negócios reais no Gemini, o custo ficou entre R$ 72 e R$ 77 por 10 mil mensagens, abaixo desta estimativa.
- Fonte: LMArena, placar de texto, conjunto de dados público no Hugging Face (licença CC BY 4.0), publicado em 13/09/2026, consultado em 25/09/2026. O que o número mede: Nota do placar de texto da LMArena, na versão com controle de estilo e na categoria geral: pessoas mandam a mesma pergunta para dois modelos sem saber quais são e votam na melhor resposta, e a LMArena transforma os votos numa nota. Quanto maior, mais vezes o modelo ganhou. A faixa de confiança é o intervalo que a própria LMArena publica para a nota. A posição é a do placar inteiro, que tem modelos fora deste catálogo. Como o nome foi casado: Mesma empresa e mesmo nome, sem contar ponto, espaço e hífen. Aceita também o nome com o nível de raciocínio no fim (high, medium, low, minimal) e o nome com data no fim quando a LMArena só conhece aquele modelo por uma data.
- Fonte: Open Portuguese LLM Leaderboard (placar aberto de modelos em português) (licença Apache 2.0), consultado em 25/09/2026. O que o número mede: Média, de 0 a 100, de nove provas em português: ENEM, vestibulares da USP e da Unicamp (BLUEX), exame da OAB, entendimento de frases (ASSIN2 RTE e STS, FaQuAD NLI), discurso de ódio (HateBR e Portuguese Hate Speech) e sentimento em tweets (TweetSentBR). O placar só avalia modelos de pesos abertos, rodando os pesos na precisão indicada, e está arquivado (não recebe modelos novos). Como o nome foi casado: O repositório avaliado no Hugging Face é o mesmo repositório oficial da empresa que o catálogo usa para o modelo.
- Fonte: Hugging Face, API pública de modelos, consultado em 25/09/2026. O que o número mede: Dados do repositório oficial da empresa no Hugging Face: a licença declarada no cartão do modelo, o total de parâmetros dos arquivos safetensors (quando o repositório publica), downloads nos últimos 30 dias e desde sempre, curtidas, a tarefa principal, se o download exige aceitar termos antes e o limite de posições do config.json (max_position_embeddings, um teto técnico que não é a janela de contexto anunciada). Como o nome foi casado: Entram os repositórios de geração de texto das organizações oficiais de cada empresa: os 6 mais baixados em 30 dias e os 6 com mais curtidas, sem versões quantizadas, modelos Base, de segurança ou de teste, com pelo menos 1.000 downloads em 30 dias. Um repositório com o mesmo nome de um modelo da página de preços da mesma empresa vira um modelo só.
- De onde vem cada linha: o preço sai da página oficial de preços de cada empresa (link na linha "Fonte do preço"), convertido pela PTAX de 24/09/2026; a janela de contexto e o que o modelo lê, da documentação oficial da empresa quando ela informa. LMArena: placar de texto com controle de estilo, categoria geral, publicado em 13/09/2026 (licença CC BY 4.0); a nota vem de votos de pessoas que comparam duas respostas às cegas. Português: Open Portuguese LLM Leaderboard, média de nove provas, só modelos abertos, consultado em 25/09/2026. Licença e parâmetros: API do Hugging Face, consultada em 25/09/2026. "sem dado" quer dizer que a fonte não tem o dado ou que o nome não casou com certeza. Modelo de pesos abertos não tem preço de API: depende de onde roda.
