DeepSeek · API e pesos abertos

DeepSeek V4 Pro

O DeepSeek V4 Pro, de DeepSeek, custa R$ 6,84 por milhão de tokens de entrada e R$ 20,51 por milhão de saída. Uma conversa de WhatsApp com 10 respostas sai por cerca de R$ 0,61.

  • Raciocina antes de responder
  • Usa ferramentas
  • Pesos abertos

Atualizado em 25/09/2026 · preço da página oficial de DeepSeek

R$ 6,84por 1 milhão de tokens de entradaUS$ 1,32 na página oficial1
saída, por 1 milhão
R$ 20,51
US$ 3,961
1 conversa no WhatsApp
R$ 0,61
10 respostas2
tokens de contexto
1 mi
documentação oficial5
posição na LMArena
57º
de 402, placar de 13/09/20263

Onde o DeepSeek V4 Pro fica no preço

52 dos 94 modelos com preço oficial custam menos na entrada; 41 custam o mesmo ou mais.

Amazon Nova Micro (Amazon): R$ 0,18GPT-5-nano (OpenAI): R$ 0,26Amazon Nova Lite (Amazon): R$ 0,31Granite 4.0 H Small (IBM): R$ 0,33Gemini 2.5 Flash Lite (Google): R$ 0,52GPT-4.1-nano (OpenAI): R$ 0,52GPT-6-luna (OpenAI): R$ 0,52Ministral 3 (3B) (Mistral AI): R$ 0,52GPT-4o-mini (OpenAI): R$ 0,78Ministral 3 (8B) (Mistral AI): R$ 0,78Mistral Small 4 (Mistral AI): R$ 0,78GPT-5.4-nano (OpenAI): R$ 1,04GPT-5.6-luna (OpenAI): R$ 1,04Ministral 3 (14B) (Mistral AI): R$ 1,04Gemini 3.1 Flash Lite (Google): R$ 1,29GPT-5-mini (OpenAI): R$ 1,29Codestral (Mistral AI): R$ 1,55DeepSeek Flash (DeepSeek): R$ 1,55Gemini 2.5 Flash (Google): R$ 1,55Gemini 3.5 Flash Lite (Google): R$ 1,55MiniMax-M2 (MiniMax): R$ 1,55MiniMax-M2.1 (MiniMax): R$ 1,55MiniMax-M2.5 (MiniMax): R$ 1,55MiniMax-M2.7 (MiniMax): R$ 1,55MiniMax-M3 (MiniMax): R$ 1,55Amazon Nova 2 Lite (Amazon): R$ 1,71GPT-4.1-mini (OpenAI): R$ 2,07Gemini 3 Flash Preview (Google): R$ 2,59GPT-3.5-turbo (OpenAI): R$ 2,59GPT-3.5-turbo-0125 (OpenAI): R$ 2,59Mistral Large 3 (Mistral AI): R$ 2,59MiniMax-M2.1 highspeed (MiniMax): R$ 3,11MiniMax-M2.5 highspeed (MiniMax): R$ 3,11MiniMax-M2.7 highspeed (MiniMax): R$ 3,11Gemini 3.6 Flash (Google): R$ 3,88Gemini 3.7 Flash (Google): R$ 3,88Gemini 3.8 Flash (Google): R$ 3,88GPT-5.4-mini (OpenAI): R$ 3,88Amazon Nova Pro (Amazon): R$ 4,14Claude Haiku 4.5 (Anthropic): R$ 5,18GPT-3.5-turbo-1106 (OpenAI): R$ 5,18Grok Build 0.1 (xAI): R$ 5,18o3-mini (OpenAI): R$ 5,70o4-mini (OpenAI): R$ 5,70Gemini 2.5 Pro (Google): R$ 6,47GPT-5 (OpenAI): R$ 6,47GPT-5.1 (OpenAI): R$ 6,47Grok 4.20 0309 Non Reasoning (xAI): R$ 6,47Grok 4.20 0309 Reasoning (xAI): R$ 6,47Grok 4.20 Multi Agent 0309 (xAI): R$ 6,47Grok 4.3 (xAI): R$ 6,47Muse Spark 1.3 (Meta): R$ 6,47DeepSeek V4 Pro (DeepSeek): R$ 6,84Amazon Nova 2 Pro (Amazon): R$ 7,12Gemini 3.5 Flash (Google): R$ 7,77Mistral Medium 3.5 (Mistral AI): R$ 7,77GPT-5.2 (OpenAI): R$ 9,06Claude Sonnet 5 (Anthropic): R$ 10,36Gemini 3.1 Pro Preview (Google): R$ 10,36GPT-4.1 (OpenAI): R$ 10,36GPT-5.6-terra (OpenAI): R$ 10,36GPT-6-sol (OpenAI): R$ 10,36Grok 4.5 (xAI): R$ 10,36Grok 4.6 (xAI): R$ 10,36Grok 4.7 (xAI): R$ 10,36o3 (OpenAI): R$ 10,36Amazon Nova Premier (Amazon): R$ 12,95GPT-4o (OpenAI): R$ 12,95GPT-5.4 (OpenAI): R$ 12,95Claude Sonnet 4.5 (Anthropic): R$ 15,54Claude Sonnet 4.6 (Anthropic): R$ 15,54Claude Opus 5.5 (Anthropic): R$ 20,72GPT-5.6-sol (OpenAI): R$ 20,72Claude Opus 4.5 (Anthropic): R$ 25,90Claude Opus 4.6 (Anthropic): R$ 25,90Claude Opus 4.7 (Anthropic): R$ 25,90Claude Opus 4.8 (Anthropic): R$ 25,90Claude Opus 5 (Anthropic): R$ 25,90GPT-4o-2024-05-13 (OpenAI): R$ 25,90GPT-5.5 (OpenAI): R$ 25,90Claude Fable 5 (Anthropic): R$ 51,80Claude Fable 5.1 (Anthropic): R$ 51,80Claude Mythos 5 (Anthropic): R$ 51,80Claude Mythos 5.1 (Anthropic): R$ 51,80GPT-4-turbo-2024-04-09 (OpenAI): R$ 51,80GPT-6-astra (OpenAI): R$ 51,80GPT-5-pro (OpenAI): R$ 77,69o1 (OpenAI): R$ 77,69o3-pro (OpenAI): R$ 103,59GPT-5.2-pro (OpenAI): R$ 108,77GPT-4-0613 (OpenAI): R$ 155,39GPT-5.4-pro (OpenAI): R$ 155,39GPT-5.5-pro (OpenAI): R$ 155,39o1-pro (OpenAI): R$ 776,93R$ 1R$ 10R$ 100DeepSeek V4 Pro: R$ 6,84
R$ 0,18o mais barato, Amazon Nova Micro
R$ 6,47a mediana dos 94
R$ 776,93o mais caro, o1-pro
Cada traço é um modelo com preço oficial; onde os traços se juntam, a cor fica mais forte. O traço preto é a mediana. Escala logarítmica: cada marca do eixo vale dez vezes a anterior. R$ por 1 milhão de tokens de entrada, pela PTAX de 24/09/2026.

Preço

Por 1 milhão de tokens.
Tipo de tokenR$US$1
Entrada o que o modelo lêR$ 6,84US$ 1,32
Saída o que o modelo escreveR$ 20,51US$ 3,96
Entrada lida do cache texto repetido que a empresa guardaR$ 0,23US$ 0,044

Histórico de preço: um registro até agora, de 25/09/2026. A curva aparece aqui no dia em que o preço mudar, sem curva inventada.

Quanto custa no WhatsApp

UsoCusto estimado
1 resposta do agenteR$ 0,061
1 conversa (10 respostas)R$ 0,61
1.000 respostas por mêsR$ 60,85
10.000 respostas por mêsR$ 608,49

Premissa: cada resposta lê 8.000 tokens e escreve 300.2

Qualidade nos testes

LMArena3

DeepSeek V4 Pro: 57º1º, o mais bem colocado402º
Placar de texto da LMArena de 13/09/2026. Os traços cinza são os outros modelos deste catálogo que estão no placar.
Nome na LMArenaPosiçãoNota e faixaVotosData do placar
deepseek-v4-pro57º de 4021.457,3 1.453,3 a 1.461,354.13013/09/2026

Testes publicados pela empresa7

TesteNotaComo a empresa mediu
SWE Verified (Resolved)80,6Think Max (DS-V4-Pro Max)
Terminal Bench 2.0 (Acc)67,9Think Max (DS-V4-Pro Max)
GPQA Diamond (Pass@1)90,1Think Max (DS-V4-Pro Max), pass@1
MMLU-Pro (EM)87,5Think Max (DS-V4-Pro Max)
HLE (Pass@1)37,7Think Max (DS-V4-Pro Max), pass@1, no tools
LiveCodeBench (Pass@1)93,5Think Max (DS-V4-Pro Max), pass@1
HMMT 2026 Feb (Pass@1)95,2Think Max (DS-V4-Pro Max), pass@1
BrowseComp (Pass@1)83,4Think Max (DS-V4-Pro Max), pass@1

Em português: o repositório deepseek-ai/DeepSeek-V4-Pro não foi avaliado no Open Portuguese LLM Leaderboard, que está arquivado e não recebe modelos novos (última avaliação em 01/09/2025).6

Ficha do DeepSeek V4 Pro

Origem

EmpresaDeepSeek
TipoAPI e pesos abertos
Nome na página de preçosdeepseek-v4-pro
Publicado no Hugging Face em22/04/2026

Capacidade

Janela de contexto1.000.000 tokens5
Saída máxima384.000 tokens
O que lêtexto
O que geratexto
Raciocina antes de respondersim
Usa ferramentas (chamada de função)sim

Acesso

API da empresasim, com preço oficial
Pesos abertosdeepseek-ai/DeepSeek-V4-Pro
Licença declaradamit4
Parâmetros1,60 trilhão 1.598.839.674.782
Downloads em 30 dias499.898
Downloads desde a publicação10.607.945
Curtidas no Hugging Face5.593
Download exige aceitar termos antesnão
Limite de posições no config.json1.048.576 teto técnico do arquivo, não é a janela de contexto anunciada

Outras contas grátis: quanto custa colocar IA no seu negócio, quanto custa o WhatsApp sem resposta e quanto custa contratar um atendente. Para quem programa: o blog técnico de IA.

Como Certu pode ajudar

Você não precisa escolher modelo, contar token nem montar servidor. Certu monta um agente de IA que responde seus clientes no WhatsApp pela API oficial da Meta, com o que o seu negócio sabe responder. O plano Start custa R$ 299 por mês e já vem com 1.600 respostas.

Fontes e método
  1. Fonte do preço: DeepSeek - Models & Pricing (documentacao oficial da API), lida em 25/09/2026. Nome do modelo na página: deepseek-v4-pro. A DeepSeek cobra metade fora do horário de pico (pico: 01-04h e 06-10h UTC em dias úteis, segundo a página). Empresa chinesa: avaliar LGPD e transferência internacional antes de usar com dado pessoal. Como a página foi lida: Página de preços da documentação. Os termos de uso da DeepSeek proíbem copiar conteúdo com robôs; o catálogo não baixa a página sozinho. Preço de tabela da API, camada padrão, sem desconto de lote, cache ou contrato. Entrada é o que o modelo lê; saída é o que ele escreve. Cache é o preço da entrada que a empresa já guardou de uma pergunta anterior, quando a página informa. Real pela PTAX de venda do Banco Central de 24/09/2026: R$ 5,1795 por dólar.
  2. A conta da conversa: 10 respostas do agente, cada uma lendo 8.000 tokens de entrada (instruções, o que a empresa sabe e o histórico da conversa) e escrevendo 300 tokens de saída. É a base que Certu usa para estimar o custo por resposta. Não entra desconto de cache nem os tokens extras dos modelos que "pensam" antes de responder, então modelo que raciocina pode sair mais caro. Numa medição de Certu de 05/08/2026, com dois negócios reais no Gemini, o custo ficou entre R$ 72 e R$ 77 por 10 mil mensagens, abaixo desta estimativa.
  3. Fonte: LMArena, placar de texto, conjunto de dados público no Hugging Face (licença CC BY 4.0), publicado em 13/09/2026, consultado em 25/09/2026. O que o número mede: Nota do placar de texto da LMArena, na versão com controle de estilo e na categoria geral: pessoas mandam a mesma pergunta para dois modelos sem saber quais são e votam na melhor resposta, e a LMArena transforma os votos numa nota. Quanto maior, mais vezes o modelo ganhou. A faixa de confiança é o intervalo que a própria LMArena publica para a nota. A posição é a do placar inteiro, que tem modelos fora deste catálogo. Como o nome foi casado: Mesma empresa e mesmo nome, sem contar ponto, espaço e hífen. Aceita também o nome com o nível de raciocínio no fim (high, medium, low, minimal) e o nome com data no fim quando a LMArena só conhece aquele modelo por uma data. Como cada nome casou com este modelo: deepseek-v4-pro: mesmo nome.
  4. Fonte: Hugging Face, API pública de modelos, consultado em 25/09/2026. O que o número mede: Dados do repositório oficial da empresa no Hugging Face: a licença declarada no cartão do modelo, o total de parâmetros dos arquivos safetensors (quando o repositório publica), downloads nos últimos 30 dias e desde sempre, curtidas, a tarefa principal, se o download exige aceitar termos antes e o limite de posições do config.json (max_position_embeddings, um teto técnico que não é a janela de contexto anunciada). Como o nome foi casado: Entram os repositórios de geração de texto das organizações oficiais de cada empresa: os 6 mais baixados em 30 dias e os 6 com mais curtidas, sem versões quantizadas, modelos Base, de segurança ou de teste, com pelo menos 1.000 downloads em 30 dias. Um repositório com o mesmo nome de um modelo da página de preços da mesma empresa vira um modelo só.
  5. Janela de contexto: página oficial, lida em 25/09/2026 (a documentação oficial do modelo escreve "CONTEXT LENGTH 1M"). O que lê e gera, saída máxima, raciocínio e ferramentas: documentação oficial de DeepSeek, lida à mão em 25/09/2026. Campo que a fonte oficial não traz fica fora da ficha e aparece na linha "Não informado na fonte oficial".
  6. Fonte: Open Portuguese LLM Leaderboard (placar aberto de modelos em português) (licença Apache 2.0), consultado em 25/09/2026. O que o número mede: Média, de 0 a 100, de nove provas em português: ENEM, vestibulares da USP e da Unicamp (BLUEX), exame da OAB, entendimento de frases (ASSIN2 RTE e STS, FaQuAD NLI), discurso de ódio (HateBR e Portuguese Hate Speech) e sentimento em tweets (TweetSentBR). O placar só avalia modelos de pesos abertos, rodando os pesos na precisão indicada, e está arquivado (não recebe modelos novos). Como o nome foi casado: O repositório avaliado no Hugging Face é o mesmo repositório oficial da empresa que o catálogo usa para o modelo. A média normalizada (NPM) desconta o que um chute ao acaso acertaria em cada prova.
  7. Fonte: informado pela empresa em deepseek-ai/DeepSeek-V4-Pro · Hugging Face (model card: DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence), página sem data de publicação, lido por Certu em 25/09/2026. A página imprime estes números sem unidade (sem o sinal de porcentagem), e aqui eles aparecem do mesmo jeito. Número informado pela empresa, nas condições que ela descreve (por exemplo, com ou sem ferramentas, com raciocínio ligado). Empresas diferentes testam de jeitos diferentes, então dois números de empresas diferentes não são comparáveis um a um. A coluna "Como a empresa mediu" resume a condição do teste escrita na página, em inglês.