Modelos de IA: preço em reais, contexto e custo no WhatsApp
O catálogo tem 257 modelos de IA de 27 empresas, 94 com preço oficial em dólar e em real. O mais barato por milhão de tokens de entrada é o Amazon Nova Micro, de Amazon, a R$ 0,18; o mais caro é o o1-pro, a R$ 776,93.
As ferramentas
O catálogo em números
Empresas
| Empresa | Modelos | Mais barato2 | Mais caro | País3 |
|---|---|---|---|---|
| OpenAI | 38 | R$ 0,027 | R$ 71,48 | Estados Unidos |
| 20 | R$ 0,048 | R$ 1,02 | Estados Unidos | |
| Anthropic | 14 | R$ 0,49 | R$ 4,92 | Estados Unidos |
| IBM | 12 | R$ 0,030 | R$ 0,030 | Estados Unidos |
| Qwen | 11 | só pesos abertos | República Popular da China | |
| DeepSeek | 10 | R$ 0,14 | R$ 0,61 | República Popular da China |
| inclusionAI | 10 | só pesos abertos | sem dado | |
| MiniMax | 10 | R$ 0,14 | R$ 0,29 | República Popular da China |
| Mistral AI | 10 | R$ 0,043 | R$ 0,74 | França |
| Cohere | 9 | só pesos abertos | Canadá | |
| Liquid AI | 9 | só pesos abertos | sem dado | |
| Meta | 9 | R$ 0,58 | R$ 0,58 | Estados Unidos |
| Nous Research | 9 | só pesos abertos | sem dado | |
| Microsoft | 8 | só pesos abertos | Estados Unidos | |
| Moonshot AI | 8 | só pesos abertos | República Popular da China | |
| xAI | 8 | R$ 0,45 | R$ 0,92 | Estados Unidos |
| Z.ai | 8 | só pesos abertos | República Popular da China | |
| NVIDIA | 7 | só pesos abertos | Estados Unidos | |
| Tencent | 7 | só pesos abertos | República Popular da China | |
| Xiaomi | 7 | só pesos abertos | República Popular da China | |
| Amazon | 6 | R$ 0,017 | R$ 1,23 | Estados Unidos |
| Upstage | 6 | só pesos abertos | Coreia do Sul | |
| Arcee AI | 5 | só pesos abertos | sem dado | |
| Baidu | 5 | só pesos abertos | República Popular da China | |
| AI21 Labs | 4 | só pesos abertos | sem dado | |
| StepFun | 4 | só pesos abertos | República Popular da China | |
| ByteDance Seed | 3 | só pesos abertos | República Popular da China |
Os 10 mais baratos por conversa2
| # | Modelo | Empresa | Entrada | Conversa |
|---|---|---|---|---|
| 1 | Amazon Nova Micro | Amazon | R$ 0,18 | R$ 0,017 |
| 2 | GPT-5-nano | OpenAI | R$ 0,26 | R$ 0,027 |
| 3 | Amazon Nova Lite | Amazon | R$ 0,31 | R$ 0,029 |
| 4 | Granite 4.0 H Small | IBM | R$ 0,33 | R$ 0,030 |
| 5 | Ministral 3 (3B) | Mistral AI | R$ 0,52 | R$ 0,043 |
| 6 | Gemini 2.5 Flash Lite | R$ 0,52 | R$ 0,048 | |
| 7 | GPT-4.1-nano | OpenAI | R$ 0,52 | R$ 0,048 |
| 8 | GPT-6-luna | OpenAI | R$ 0,52 | R$ 0,049 |
| 9 | Ministral 3 (8B) | Mistral AI | R$ 0,78 | R$ 0,064 |
| 10 | GPT-4o-mini | OpenAI | R$ 0,78 | R$ 0,071 |
Ver os 94 modelos com preço na tabela completa
Os mais bem colocados na LMArena4
89 modelos do catálogo aparecem no placar de texto da LMArena de 13/09/2026.
| Posição | Modelo | Empresa | Nota | Votos |
|---|---|---|---|---|
| 1º | Claude Fable 5 | Anthropic | 1.505,7 | 30.057 |
| 2º | Claude Opus 4.6 high | Anthropic | 1.504,6 | 71.993 |
| 3º | Claude Opus 4.7 high | Anthropic | 1.501,7 | 60.002 |
| 9º | Gemini 3.8 Flash high | 1.493 | 5.076 | |
| 10º | Claude Opus 5 high | Anthropic | 1.492,9 | 42.617 |
| 12º | Gemini 3.7 Flash high | 1.489,8 | 5.640 | |
| 15º | Gemini 3.1 Pro Preview | 1.486,8 | 106.951 | |
| 18º | GPT-5.6-sol xhigh | OpenAI | 1.483,5 | 27.069 |
| 20º | GPT-5.5 high | OpenAI | 1.481,8 | 64.924 |
| 21º | Claude Opus 4.8 high | Anthropic | 1.481,4 | 52.535 |
Os melhores modelos abertos em português5
| Modelo | Empresa | Média (0 a 100) | Precisão | Avaliado em |
|---|---|---|---|---|
| Qwen3-8B | Qwen | 78,35 | bfloat16 | 01/05/2025 |
| phi-4 | Microsoft | 76,1 | bfloat16 | 29/01/2025 |
| Qwen2.5-Coder-32B-Instruct | Qwen | 74,74 | bfloat16 | 12/11/2024 |
| ERNIE-4.5-21B-A3B-PT | Baidu | 74,47 | bfloat16 | 31/08/2025 |
| gemma-2-9b-it | 74,31 | bfloat16 | 02/07/2024 |
Modelos abertos mais baixados6
| Modelo | Empresa | Downloads em 30 dias | Licença |
|---|---|---|---|
| Qwen3-0.6B | Qwen | 28.114.690 | apache-2.0 |
| Qwen3-VL-8B-Instruct | Qwen | 19.149.628 | apache-2.0 |
| Qwen3-8B | Qwen | 12.343.793 | apache-2.0 |
| gemma-4-26B-A4B-it | 11.073.424 | apache-2.0 | |
| Qwen3.5-9B | Qwen | 9.781.405 | apache-2.0 |
Como Certu pode ajudar
O agente de WhatsApp de Certu usa o Gemini 3.1 Flash Lite por padrão, em todos os planos (conferido no código em 25/09/2026): cerca de R$ 0,13 por conversa de 10 respostas.
Você não precisa escolher modelo, contar token nem montar servidor. Certu monta um agente de IA que responde seus clientes no WhatsApp pela API oficial da Meta, com o que o seu negócio sabe responder. O plano Start custa R$ 299 por mês e já vem com 1.600 respostas.
Outras contas grátis: quanto custa colocar IA no seu negócio, quanto custa o WhatsApp sem resposta e quanto custa contratar um atendente. Para quem programa: o blog técnico de IA.
Fontes e método
- Preços lidos na página oficial de preços de cada empresa (a página e a data de cada preço estão na ficha do modelo); modelos de pesos abertos pela API do Hugging Face, consultada em 25/09/2026. Real pela PTAX de venda do Banco Central de 24/09/2026: R$ 5,1795 por dólar.
- A conta da conversa: 10 respostas do agente, cada uma lendo 8.000 tokens de entrada (instruções, o que a empresa sabe e o histórico da conversa) e escrevendo 300 tokens de saída. É a base que Certu usa para estimar o custo por resposta. Não entra desconto de cache nem os tokens extras dos modelos que "pensam" antes de responder, então modelo que raciocina pode sair mais caro. Numa medição de Certu de 05/08/2026, com dois negócios reais no Gemini, o custo ficou entre R$ 72 e R$ 77 por 10 mil mensagens, abaixo desta estimativa.
- Fonte: Wikidata (licença CC0), consultado em 25/09/2026. O que o número mede: País (P17), data de fundação (P571), sede (P159) e site oficial (P856) do item da empresa no Wikidata. Como o nome foi casado: Item escolhido à mão e conferido pelo site oficial: o site do item tem de estar no domínio da empresa.
- Fonte: LMArena, placar de texto, conjunto de dados público no Hugging Face (licença CC BY 4.0), publicado em 13/09/2026, consultado em 25/09/2026. O que o número mede: Nota do placar de texto da LMArena, na versão com controle de estilo e na categoria geral: pessoas mandam a mesma pergunta para dois modelos sem saber quais são e votam na melhor resposta, e a LMArena transforma os votos numa nota. Quanto maior, mais vezes o modelo ganhou. A faixa de confiança é o intervalo que a própria LMArena publica para a nota. A posição é a do placar inteiro, que tem modelos fora deste catálogo. Como o nome foi casado: Mesma empresa e mesmo nome, sem contar ponto, espaço e hífen. Aceita também o nome com o nível de raciocínio no fim (high, medium, low, minimal) e o nome com data no fim quando a LMArena só conhece aquele modelo por uma data.
- Fonte: Open Portuguese LLM Leaderboard (placar aberto de modelos em português) (licença Apache 2.0), consultado em 25/09/2026. O que o número mede: Média, de 0 a 100, de nove provas em português: ENEM, vestibulares da USP e da Unicamp (BLUEX), exame da OAB, entendimento de frases (ASSIN2 RTE e STS, FaQuAD NLI), discurso de ódio (HateBR e Portuguese Hate Speech) e sentimento em tweets (TweetSentBR). O placar só avalia modelos de pesos abertos, rodando os pesos na precisão indicada, e está arquivado (não recebe modelos novos). Como o nome foi casado: O repositório avaliado no Hugging Face é o mesmo repositório oficial da empresa que o catálogo usa para o modelo. A média normalizada (NPM) desconta o que um chute ao acaso acertaria em cada prova.
- Fonte: Hugging Face, API pública de modelos, consultado em 25/09/2026. O que o número mede: Dados do repositório oficial da empresa no Hugging Face: a licença declarada no cartão do modelo, o total de parâmetros dos arquivos safetensors (quando o repositório publica), downloads nos últimos 30 dias e desde sempre, curtidas, a tarefa principal, se o download exige aceitar termos antes e o limite de posições do config.json (max_position_embeddings, um teto técnico que não é a janela de contexto anunciada). Como o nome foi casado: Entram os repositórios de geração de texto das organizações oficiais de cada empresa: os 6 mais baixados em 30 dias e os 6 com mais curtidas, sem versões quantizadas, modelos Base, de segurança ou de teste, com pelo menos 1.000 downloads em 30 dias. Um repositório com o mesmo nome de um modelo da página de preços da mesma empresa vira um modelo só.
As páginas oficiais de preço
Sem preço de API aqui: Qwen (os termos da Alibaba Cloud proíbem coletar conteúdo com robôs sem autorização por escrito); Z.ai (os termos da Z.ai proíbem robôs e outros meios automatizados para obter dados); Moonshot AI (o acordo de uso da Moonshot proíbe extrair dados dos serviços por outro meio que não a API); Microsoft (os termos de uso da Microsoft proíbem copiar ou reproduzir informação obtida dos serviços); Cohere (os termos da Cohere proíbem copiar ou guardar parte relevante do conteúdo do site); AI21 Labs (os termos da AI21 proíbem acessar o conteúdo do site por processo automatizado); rekaai (os termos da Reka proíbem robôs, raspadores e rastreadores); writer (os termos da Writer proíbem raspagem e rastreadores); perplexity (os termos da Perplexity não puderam ser lidos (o site barra robô) e a própria página avisa que a API Sonar deixa de ser mantida em 27/09/2026). Nesses casos o preço existe na página da empresa, mas não foi lido para cá; os modelos abertos dessas empresas aparecem sem preço.
Como a conta é feita: o preço de um modelo de IA é cobrado por token, que é um pedaço de palavra. Entrada é o que o modelo lê; saída é o que ele escreve. O preço em real é o preço em dólar vezes a PTAX de venda do último dia útil.
Histórico: começou em 25/09/2026. Até agora nenhum preço mudou desde o primeiro registro; a lista de quedas aparece nesta página no dia em que um preço mudar.
O que ficou fora do catálogo: das páginas oficiais de preço, 32 modelos: 18 (modelo de voz, áudio, imagem ou robótica: o preço por token não é de conversa em texto); 4 (aposentado na API da empresa); 3 (modelo antigo de completar texto, não de conversa); 2 (modelo de voz: o preço por token não é de conversa em texto); 2 (modelo de outra empresa revendido nesta página); 1 (modelo de vetores (embeddings), não de conversa); 1 (marcado como descontinuado na página); 1 (modelo de segurança (moderação), marcado como descontinuado na página).
