ANAnthropic · API
Claude Sonnet 5
O Claude Sonnet 5, de Anthropic, custa R$ 10,36 por milhão de tokens de entrada e R$ 51,80 por milhão de saída. Uma conversa de WhatsApp com 10 respostas sai por cerca de R$ 0,98.
- Lê imagem
- Raciocina antes de responder
- Usa ferramentas
Onde o Claude Sonnet 5 fica no preço
57 dos 94 modelos com preço oficial custam menos na entrada; 36 custam o mesmo ou mais.
Preço
| Tipo de token | R$ | US$1 |
|---|---|---|
| Entrada o que o modelo lê | R$ 10,36 | US$ 2,00 |
| Saída o que o modelo escreve | R$ 51,80 | US$ 10,00 |
| Entrada lida do cache texto repetido que a empresa guarda | R$ 1,04 | US$ 0,20 |
Histórico de preço: um registro até agora, de 25/09/2026. A curva aparece aqui no dia em que o preço mudar, sem curva inventada.
Quanto custa no WhatsApp
| Uso | Custo estimado |
|---|---|
| 1 resposta do agente | R$ 0,098 |
| 1 conversa (10 respostas) | R$ 0,98 |
| 1.000 respostas por mês | R$ 98,41 |
| 10.000 respostas por mês | R$ 984,11 |
Premissa: cada resposta lê 8.000 tokens e escreve 300.2
Claude Sonnet 5 e os modelos de Anthropic de preço parecido
R$ por 1 milhão de tokens de entrada. Os 9 mais próximos no preço, dos 14 de Anthropic com preço oficial.
Qualidade nos testes
LMArena3
| Nome na LMArena | Posição | Nota e faixa | Votos | Data do placar |
|---|---|---|---|---|
claude-sonnet-5-high | 51º de 402 | 1.461,2 1.456,6 a 1.465,8 | 35.301 | 13/09/2026 |
Testes publicados pela empresa5
| Teste | Nota | Como a empresa mediu |
|---|---|---|
| SWE-bench Verified | 85,2% | average over five trials; adaptive thinking at max effort |
| SWE-bench Pro | 63,2% | average over five trials; adaptive thinking at max effort |
| Terminal-Bench 2.1 | 80,4% | mean reward, xhigh effort, mini-SWE-agent harness; averaged over 5 attempts per task (445 trials) |
| Humanity's Last Exam | 43,2 | no tools; adaptive thinking at max effort, averaged over 5 trials |
| Humanity's Last Exam | 57,4 | with tools; adaptive thinking at max effort, averaged over 5 trials |
| OSWorld-Verified | 81,2% | first-attempt success rate, averaged over five runs; max effort |
Ficha do Claude Sonnet 5
Origem
| Empresa | Anthropic |
|---|---|
| Tipo | API |
| Nome na página de preços | Claude Sonnet 5 |
Capacidade
| Janela de contexto | 1.000.000 tokens4 |
|---|---|
| Saída máxima | 128.000 tokens |
| O que lê | texto e imagem |
| O que gera | texto |
| Raciocina antes de responder | sim |
| Usa ferramentas (chamada de função) | sim |
Acesso
| API da empresa | sim, com preço oficial |
|---|---|
| Pesos abertos | não |
Outras contas grátis: quanto custa colocar IA no seu negócio, quanto custa o WhatsApp sem resposta e quanto custa contratar um atendente. Para quem programa: o blog técnico de IA.
Como Certu pode ajudar
Você não precisa escolher modelo, contar token nem montar servidor. Certu monta um agente de IA que responde seus clientes no WhatsApp pela API oficial da Meta, com o que o seu negócio sabe responder. O plano Start custa R$ 299 por mês e já vem com 1.600 respostas.
Fontes e método
- Fonte do preço: Anthropic - Claude API pricing (documentacao oficial), lida em 25/09/2026. Nome do modelo na página:
Claude Sonnet 5. A Anthropic informa que o preço introdutório virou preço padrão. Tokenizador novo gera ~30% mais tokens para o mesmo texto (segundo a Anthropic), o que encarece o custo real por texto. Como a página foi lida: Página em Markdown da documentação. O robots.txt não a bloqueia, mas os termos de consumidor da Anthropic proíbem raspar dados dos serviços; o catálogo não baixa a página sozinho. Preço de tabela da API, camada padrão, sem desconto de lote, cache ou contrato. Entrada é o que o modelo lê; saída é o que ele escreve. Cache é o preço da entrada que a empresa já guardou de uma pergunta anterior, quando a página informa. Real pela PTAX de venda do Banco Central de 24/09/2026: R$ 5,1795 por dólar. - A conta da conversa: 10 respostas do agente, cada uma lendo 8.000 tokens de entrada (instruções, o que a empresa sabe e o histórico da conversa) e escrevendo 300 tokens de saída. É a base que Certu usa para estimar o custo por resposta. Não entra desconto de cache nem os tokens extras dos modelos que "pensam" antes de responder, então modelo que raciocina pode sair mais caro. Numa medição de Certu de 05/08/2026, com dois negócios reais no Gemini, o custo ficou entre R$ 72 e R$ 77 por 10 mil mensagens, abaixo desta estimativa.
- Fonte: LMArena, placar de texto, conjunto de dados público no Hugging Face (licença CC BY 4.0), publicado em 13/09/2026, consultado em 25/09/2026. O que o número mede: Nota do placar de texto da LMArena, na versão com controle de estilo e na categoria geral: pessoas mandam a mesma pergunta para dois modelos sem saber quais são e votam na melhor resposta, e a LMArena transforma os votos numa nota. Quanto maior, mais vezes o modelo ganhou. A faixa de confiança é o intervalo que a própria LMArena publica para a nota. A posição é a do placar inteiro, que tem modelos fora deste catálogo. Como o nome foi casado: Mesma empresa e mesmo nome, sem contar ponto, espaço e hífen. Aceita também o nome com o nível de raciocínio no fim (high, medium, low, minimal) e o nome com data no fim quando a LMArena só conhece aquele modelo por uma data. Como cada nome casou com este modelo:
claude-sonnet-5-high: mesmo modelo, nível de raciocínio "high". - Janela de contexto: página oficial, lida em 25/09/2026 (a documentação oficial do modelo escreve "1M tokens"). O que lê e gera, saída máxima, raciocínio e ferramentas: documentação oficial de Anthropic, lida à mão em 25/09/2026. Campo que a fonte oficial não traz fica fora da ficha e aparece na linha "Não informado na fonte oficial".
- Fonte: informado pela empresa em System Card: Claude Sonnet 5, publicado em 30/06/2026, lido por Certu em 25/09/2026. A página imprime parte destes números sem unidade (sem o sinal de porcentagem), e aqui eles aparecem do mesmo jeito. Número informado pela empresa, nas condições que ela descreve (por exemplo, com ou sem ferramentas, com raciocínio ligado). Empresas diferentes testam de jeitos diferentes, então dois números de empresas diferentes não são comparáveis um a um. A coluna "Como a empresa mediu" resume a condição do teste escrita na página, em inglês.
