DeepSeek V4 Pro custa 8 vezes menos que o GPT-5.3-Codex por inteligência quase igual
Lançado ontem, o V4 Pro 0423 entra como terceiro colocado em intelligence e o mais barato acima de IQ 45 no catálogo. Onde ele abre frente em agentic e onde o trade-off não compensa.
A conta que abre o olho
US$ 1,74 por milhão de tokens de saída. Esse é o número do DeepSeek V4 Pro 0423, lançado ontem. O GPT-5.3-Codex, da OpenAI, cobra US$ 14 pela mesma unidade. O Gemini 3.1 Pro Preview, do Google, cobra US$ 12. Quando os três estão na mesma faixa de intelligence — 45,27, 45,51 e 47,74, respectivamente — é a tarifa, não o benchmark, que decide.
O que ele entrega em uma frase
Mixture-of-Experts com 1,6 trilhão de parâmetros totais e 49 bilhões ativados por inferência, contexto de 1 milhão de tokens, pesos abertos, raciocínio nativo. Em capacidade, ele segura a régua acima de IQ 45 cobrando uma fração do que pedem os dois modelos americanos na mesma faixa.
| Campo | Valor |
|---|---|
| Identificador | deepseek/deepseek-v4-pro |
| Criador | deepseek |
| Preço de entrada | US$ 1.04 / M tokens |
| Preço de saída | US$ 2.08 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.087 / M (92% de desconto) |
| Índice de inteligência (AA) | 45.3 |
| Índice de código | 59.4 |
| Índice agêntico | 37.8 |
| Parâmetros | 1600B (49B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 58 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Onde o V4 Pro realmente abre frente é em agentic: 37,8 no índice, contra 23,0 do Gemini e 29,5 do MiMo-V2.5-Pro da Xiaomi. Para fluxos que encadeiam ferramentas, mantêm estado entre chamadas e executam tarefas longas, essa diferença não é estética — é a diferença entre o agente terminar o trabalho ou travar na quarta etapa.
O custo efetivo que o release não calcula
O cache de prompt sai por US$ 0,0725 por milhão — cerca de 2,8 vezes mais barato que o do Gemini (US$ 0,20) e pouco mais de 40% do preço do GPT-5.3-Codex (US$ 0,175). Se o seu workload repete system prompt, few-shots ou contexto entre chamadas, o custo real cai ainda mais do que a tarifa nominal sugere.
Traduzindo para volume: rodar 10 milhões de tokens de saída por dia no V4 Pro custa US$ 17,40. No Gemini 3.1 Pro, US$ 120. No GPT-5.3-Codex, US$ 140. Mesma faixa de intelligence, fatura com um zero a menos.
Onde ele NÃO te serve
Três sinais que você precisa ler antes de migrar.
Omniscience negativo: -10,7. É o pior dos quatro modelos comparados aqui. Em prática, significa que o modelo erra fatos com a mesma confiança com que acerta. Para qualquer fluxo que dependa de resposta factual sem retrieval por trás — atendimento, extração, sumarização sem grounding — o risco de alucinação sobe.
Sem multimodalidade. O V4 Pro é text-to-text. O Gemini aceita imagem, áudio e vídeo; o GPT-5.3-Codex aceita imagem e arquivo. Se o produto depende de upload de PDF, screenshot ou transcrição, ele não entra.
Velocidade mediana. 57,8 tokens por segundo, contra 102 do Gemini e 118 do Codex. Para chat interativo onde latência define UX, ele perde.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| DeepSeek V4 Pro 0423 (o novo) | 45.3 | 1.0423 | 2.0845 | 1.05M |
| MiMo-V2.5-Pro | 42.9 | 0.435 | 0.87 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
Para quem vale trocar hoje
V4 Pro é a melhor razão custo-benefício acima de IQ 45 no catálogo agora. Pesos abertos significam que você pode hospedar, fazer fine-tuning ou mandar para um provedor com SLA próprio. Se o produto é agente de código, automação longa ou pipeline que repete contexto, vale rodar o teste A/B contra o que está no ar.
Se o produto precisa de fato correto sem retrieval, multimodalidade ou latência sub-segundo, continua com Gemini ou GPT-5.3-Codex e paga a conta que eles pedem.
A pergunta que sobra não é se o V4 Pro é bom. É se o seu produto aguenta o trade-off de omniscience negativo.
Se o seu workload é agente de código ou automação com contexto longo, o V4 Pro entrega a mesma faixa de intelligence do GPT-5.3-Codex por um oitavo do preço — desde que o produto tolere um índice de omniscience negativo e não dependa de multimodalidade.
Perguntas frequentes
Quanto custa o DeepSeek V4 Pro por milhão de tokens?
US$ 0,87 de entrada, US$ 1,74 de saída e US$ 0,0725 para cache de prompt, por milhão de tokens. É o modelo mais barato acima de IQ 45 no catálogo nesta data.
DeepSeek V4 Pro é melhor que GPT-5.3-Codex?
Não em tudo. Em intelligence eles estão colados (45,27 contra 45,51), mas o V4 Pro custa 8 vezes menos no token de saída. Em agentic, o V4 Pro lidera (37,8) entre os modelos chineses comparados; em coding benchmark o catálogo não publica nota para o Codex, então não dá para cravar vencedor nesse eixo.
O DeepSeek V4 Pro substitui o Gemini 3.1 Pro Preview?
Depende do que você faz com o Gemini. Se o caso é texto puro e o produto tolera um índice de omniscience negativo, sim — a economia é grande. Se você depende de multimodalidade (imagem, áudio, vídeo) ou de respostas factualmente precisas sem retrieval, o Gemini segue sendo a melhor opção nessa faixa.