DeepSeek V3.2 Speciale chega por 18x menos que o o3
Variante focada em raciocínio cobra US$ 0,43 por milhão de tokens de saída, mas catálogo ainda não publicou índice de inteligência do modelo.
O preço é o chamariz — o cérebro, ainda não sabemos
DeepSeek soltou hoje duas variantes do V3.2. A que chama atenção é a Speciale: US$ 0,431 por milhão de tokens de saída. Parece pouco? É. O OpenAI o3, referência atual em raciocínio, cobra US$ 8 pelo mesmo milhão. A conta é simples: 18 vezes mais barato na saída.
Só que tem um porém. O catálogo ainda não publicou índice de inteligência, benchmark de código nem score agentic para o Speciale. Você está comprando um modelo de raciocínio a preço de modelo de uso geral — mas sem saber se ele raciocina tão bem quanto o preço sugere. E isso muda tudo na hora de decidir se vale trocar.
O que é o Speciale, afinal
É uma variante de alta computação do V3.2, otimizada para raciocínio máximo e tarefas agentic. A descrição oficial menciona duas coisas: DeepSeek Sparse Attention (DSA) para processar contexto longo de forma eficiente, e um reforço agressivo no pós-treinamento com reinforcement learning.
Traduzindo: a DeepSeek pegou a base do V3.2, manteve a janela de 163.840 tokens e empurrou o modelo para ficar melhor em cadeias longas de raciocínio e em tarefas onde ele precisa agir em múltiplas etapas. É a mesma estratégia que a OpenAI usou no o3 e que a Anthropic aplicou no Claude Haiku 4.5 — só que a um preço completamente diferente.
O detalhe técnico que merece destaque é o DSA. Atenção esparsa não é novidade, mas aplicá-la num modelo de raciocínio com 163 mil tokens de contexto é o tipo de decisão que permite manter o custo baixo sem truncar a janela. Se você roda agentes que precisam de histórico longo, isso importa.
Como se compara com quem já estava no jogo
O o3 lidera o ranking de inteligência do catálogo, com IQ 31,096. O Claude Haiku 4.5 vem logo atrás, com 29,892. O gpt-oss-120b, da OpenAI, marca 24,126. O Speciale não tem nota publicada — e essa é a lacuna que define se o lançamento é disruptivo ou apenas mais uma opção barata.
No preço de saída, a distância é brutal. O gpt-oss-120b é mais barato que o Speciale (US$ 0,17/M), mas tem IQ visivelmente menor. O Speciale entra num meio-termo: preço baixo, proposta alta, resultado incerto.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Mistral Large 3 2512 (o novo) | 15.9 | 0.5 | 1.5 | 262k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
Para quem paga o3 ou Claude Haiku 4.5 em volume, o Speciale é uma proposta tentadora. Mas a tentação não substitui benchmark. Enquanto o índice de inteligência não aparecer, qualquer comparação é chute.
A família completa e para quem vale
Junto com o Speciale, a DeepSeek lançou o V3.2 "base" — mesmo contexto de 163.840 tokens, preço de saída ligeiramente menor (US$ 0,40/M) e, presumivelmente, sem o reforço de raciocínio do Speciale.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Mistral Large 3 2512 (batch) | 0.25 | 0.75 | 262k |
Para quem já usava o V3 anterior, a migração parece direta: mesma janela, preço parecido, mais foco em raciocínio no Speciale. E aqui está a pergunta que importa: vale testar se você está pagando o3 ou Claude Haiku 4.5 para tarefas agentic e quer cortar a fatura? O custo por milhão de saída é baixo o suficiente para justificar um piloto — mesmo que o modelo não bata o o3 em qualidade, pagar 5% do preço por 80% da performance já é um bom negócio.
Não muda nada para quem já está no gpt-oss-120b ou em modelos open-source de peso similar. O Speciale é fechado, e o ganho de raciocínio precisa aparecer em benchmark antes de justificar troca. Também não muda nada para quem usa o V3.2 base: o Speciale é um complemento, não um substituto.
O que falta saber
O índice de inteligência, o score de código e a nota agentic não foram publicados hoje. Enquanto não aparecerem, o Speciale é uma promessa de preço — não uma promessa de capacidade. A DeepSeek já mostrou que consegue entregar modelos competitivos a custo baixo. A questão é se o raciocínio do Speciale acompanha o marketing, ou se o preço baixo veio acompanhado de um cérebro mais simples.
Se você está decidindo agora, a jogada é clara: rode um piloto controlado com seu caso de uso real, meça qualidade por tarefa e compare o custo total com o que paga hoje. O preço de tabela é convidativo, mas o que importa é o custo por tarefa bem resolvida.
Se você paga o3 ou Claude Haiku 4.5 em volume, o V3.2 Speciale justifica um piloto hoje — mas espere o índice de inteligência aparecer antes de migrar produção.
Perguntas frequentes
DeepSeek V3.2 Speciale é melhor que o o3?
Não dá para saber ainda. O catálogo não publicou índice de inteligência, benchmark de código nem score agentic para o Speciale. O preço é 18 vezes menor que o o3 na saída, mas a qualidade do raciocínio precisa ser medida antes de qualquer conclusão.
Qual a diferença entre DeepSeek V3.2 e V3.2 Speciale?
O V3.2 base custa US$ 0,40 por milhão de tokens de saída; o Speciale custa US$ 0,43. A diferença está no pós-treinamento: o Speciale foi reforçado com reinforcement learning para raciocínio máximo e tarefas agentic, enquanto o V3.2 base mantém o perfil de uso geral.
Vale trocar o Claude Haiku 4.5 pelo DeepSeek V3.2 Speciale?
Depende do caso. O Speciale é mais de 11 vezes mais barato na saída, mas o Claude Haiku 4.5 tem IQ 29,892 no catálogo — e o Speciale não tem nota publicada. Para cargas agentic de alto volume, o piloto compensa; para tarefas onde a qualidade do raciocínio é crítica, espere benchmarks.