FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

DeepSeek V4 Pro custa 8 vezes menos que o GPT-5.3-Codex por inteligência quase igual

Lançado ontem, o V4 Pro 0423 entra como terceiro colocado em intelligence e o mais barato acima de IQ 45 no catálogo. Onde ele abre frente em agentic e onde o trade-off não compensa.

Redação FalaVIP IA 2 min de leitura
US$ 1,74por milhão de tokens de saída
8xmais barato que o GPT-5.3-Codex no token de saída
IQ 45,27terceiro colocado em intelligence no catálogo

A conta que abre o olho

US$ 1,74 por milhão de tokens de saída. Esse é o número do DeepSeek V4 Pro 0423, lançado ontem. O GPT-5.3-Codex, da OpenAI, cobra US$ 14 pela mesma unidade. O Gemini 3.1 Pro Preview, do Google, cobra US$ 12. Quando os três estão na mesma faixa de intelligence — 45,27, 45,51 e 47,74, respectivamente — é a tarifa, não o benchmark, que decide.

Índice de inteligência (Artificial Analysis)
DeepSeek V4 Pro 042345,3MiMo-V2.5-Pro42,9Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5índice
Fonte: Artificial Analysis

O que ele entrega em uma frase

Mixture-of-Experts com 1,6 trilhão de parâmetros totais e 49 bilhões ativados por inferência, contexto de 1 milhão de tokens, pesos abertos, raciocínio nativo. Em capacidade, ele segura a régua acima de IQ 45 cobrando uma fração do que pedem os dois modelos americanos na mesma faixa.

Ficha técnica — DeepSeek V4 Pro 0423
CampoValor
Identificadordeepseek/deepseek-v4-pro
Criadordeepseek
Preço de entradaUS$ 1.04 / M tokens
Preço de saídaUS$ 2.08 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.087 / M (92% de desconto)
Índice de inteligência (AA)45.3
Índice de código59.4
Índice agêntico37.8
Parâmetros1600B (49B ativos por token)
Pesosabertos
Velocidade de saída58 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Onde o V4 Pro realmente abre frente é em agentic: 37,8 no índice, contra 23,0 do Gemini e 29,5 do MiMo-V2.5-Pro da Xiaomi. Para fluxos que encadeiam ferramentas, mantêm estado entre chamadas e executam tarefas longas, essa diferença não é estética — é a diferença entre o agente terminar o trabalho ou travar na quarta etapa.

O custo efetivo que o release não calcula

O cache de prompt sai por US$ 0,0725 por milhão — cerca de 2,8 vezes mais barato que o do Gemini (US$ 0,20) e pouco mais de 40% do preço do GPT-5.3-Codex (US$ 0,175). Se o seu workload repete system prompt, few-shots ou contexto entre chamadas, o custo real cai ainda mais do que a tarifa nominal sugere.

Traduzindo para volume: rodar 10 milhões de tokens de saída por dia no V4 Pro custa US$ 17,40. No Gemini 3.1 Pro, US$ 120. No GPT-5.3-Codex, US$ 140. Mesma faixa de intelligence, fatura com um zero a menos.

Inteligência × preço de saída
DeepSeek V4 Pro 0423MiMo-V2.5-ProGemini 3.1 Pro PreviewGPT-5.3-CodexUS$ por milhão (saída, escala log)índice de inteligência

Onde ele NÃO te serve

Três sinais que você precisa ler antes de migrar.

Omniscience negativo: -10,7. É o pior dos quatro modelos comparados aqui. Em prática, significa que o modelo erra fatos com a mesma confiança com que acerta. Para qualquer fluxo que dependa de resposta factual sem retrieval por trás — atendimento, extração, sumarização sem grounding — o risco de alucinação sobe.

Sem multimodalidade. O V4 Pro é text-to-text. O Gemini aceita imagem, áudio e vídeo; o GPT-5.3-Codex aceita imagem e arquivo. Se o produto depende de upload de PDF, screenshot ou transcrição, ele não entra.

Velocidade mediana. 57,8 tokens por segundo, contra 102 do Gemini e 118 do Codex. Para chat interativo onde latência define UX, ele perde.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
DeepSeek V4 Pro 0423 (o novo)45.31.04232.08451.05M
MiMo-V2.5-Pro42.90.4350.871.05M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale trocar hoje

V4 Pro é a melhor razão custo-benefício acima de IQ 45 no catálogo agora. Pesos abertos significam que você pode hospedar, fazer fine-tuning ou mandar para um provedor com SLA próprio. Se o produto é agente de código, automação longa ou pipeline que repete contexto, vale rodar o teste A/B contra o que está no ar.

Se o produto precisa de fato correto sem retrieval, multimodalidade ou latência sub-segundo, continua com Gemini ou GPT-5.3-Codex e paga a conta que eles pedem.

A pergunta que sobra não é se o V4 Pro é bom. É se o seu produto aguenta o trade-off de omniscience negativo.

Em uma frase

Se o seu workload é agente de código ou automação com contexto longo, o V4 Pro entrega a mesma faixa de intelligence do GPT-5.3-Codex por um oitavo do preço — desde que o produto tolere um índice de omniscience negativo e não dependa de multimodalidade.

Perguntas frequentes

Quanto custa o DeepSeek V4 Pro por milhão de tokens?

US$ 0,87 de entrada, US$ 1,74 de saída e US$ 0,0725 para cache de prompt, por milhão de tokens. É o modelo mais barato acima de IQ 45 no catálogo nesta data.

DeepSeek V4 Pro é melhor que GPT-5.3-Codex?

Não em tudo. Em intelligence eles estão colados (45,27 contra 45,51), mas o V4 Pro custa 8 vezes menos no token de saída. Em agentic, o V4 Pro lidera (37,8) entre os modelos chineses comparados; em coding benchmark o catálogo não publica nota para o Codex, então não dá para cravar vencedor nesse eixo.

O DeepSeek V4 Pro substitui o Gemini 3.1 Pro Preview?

Depende do que você faz com o Gemini. Se o caso é texto puro e o produto tolera um índice de omniscience negativo, sim — a economia é grande. Se você depende de multimodalidade (imagem, áudio, vídeo) ou de respostas factualmente precisas sem retrieval, o Gemini segue sendo a melhor opção nessa faixa.

Leia também