FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

DeepSeek V3.2 Speciale chega por 18x menos que o o3

Variante focada em raciocínio cobra US$ 0,43 por milhão de tokens de saída, mas catálogo ainda não publicou índice de inteligência do modelo.

Redação FalaVIP IA 3 min de leitura
US$ 0,431por milhão de tokens de saída
163.840tokens de contexto
18xmais barato que o o3 na saída

O preço é o chamariz — o cérebro, ainda não sabemos

DeepSeek soltou hoje duas variantes do V3.2. A que chama atenção é a Speciale: US$ 0,431 por milhão de tokens de saída. Parece pouco? É. O OpenAI o3, referência atual em raciocínio, cobra US$ 8 pelo mesmo milhão. A conta é simples: 18 vezes mais barato na saída.

Preço de saída (US$ por milhão de tokens)
Mistral Large 3 25121,5o38Claude Haiku 4.55gpt-oss-120b0,17US$/M
Fonte: OpenRouter

Só que tem um porém. O catálogo ainda não publicou índice de inteligência, benchmark de código nem score agentic para o Speciale. Você está comprando um modelo de raciocínio a preço de modelo de uso geral — mas sem saber se ele raciocina tão bem quanto o preço sugere. E isso muda tudo na hora de decidir se vale trocar.

O que é o Speciale, afinal

É uma variante de alta computação do V3.2, otimizada para raciocínio máximo e tarefas agentic. A descrição oficial menciona duas coisas: DeepSeek Sparse Attention (DSA) para processar contexto longo de forma eficiente, e um reforço agressivo no pós-treinamento com reinforcement learning.

Traduzindo: a DeepSeek pegou a base do V3.2, manteve a janela de 163.840 tokens e empurrou o modelo para ficar melhor em cadeias longas de raciocínio e em tarefas onde ele precisa agir em múltiplas etapas. É a mesma estratégia que a OpenAI usou no o3 e que a Anthropic aplicou no Claude Haiku 4.5 — só que a um preço completamente diferente.

O detalhe técnico que merece destaque é o DSA. Atenção esparsa não é novidade, mas aplicá-la num modelo de raciocínio com 163 mil tokens de contexto é o tipo de decisão que permite manter o custo baixo sem truncar a janela. Se você roda agentes que precisam de histórico longo, isso importa.

Como se compara com quem já estava no jogo

O o3 lidera o ranking de inteligência do catálogo, com IQ 31,096. O Claude Haiku 4.5 vem logo atrás, com 29,892. O gpt-oss-120b, da OpenAI, marca 24,126. O Speciale não tem nota publicada — e essa é a lacuna que define se o lançamento é disruptivo ou apenas mais uma opção barata.

No preço de saída, a distância é brutal. O gpt-oss-120b é mais barato que o Speciale (US$ 0,17/M), mas tem IQ visivelmente menor. O Speciale entra num meio-termo: preço baixo, proposta alta, resultado incerto.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Mistral Large 3 2512 (o novo)15.90.51.5262k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem paga o3 ou Claude Haiku 4.5 em volume, o Speciale é uma proposta tentadora. Mas a tentação não substitui benchmark. Enquanto o índice de inteligência não aparecer, qualquer comparação é chute.

A família completa e para quem vale

Junto com o Speciale, a DeepSeek lançou o V3.2 "base" — mesmo contexto de 163.840 tokens, preço de saída ligeiramente menor (US$ 0,40/M) e, presumivelmente, sem o reforço de raciocínio do Speciale.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Mistral Large 3 2512 (batch)0.250.75262k

Para quem já usava o V3 anterior, a migração parece direta: mesma janela, preço parecido, mais foco em raciocínio no Speciale. E aqui está a pergunta que importa: vale testar se você está pagando o3 ou Claude Haiku 4.5 para tarefas agentic e quer cortar a fatura? O custo por milhão de saída é baixo o suficiente para justificar um piloto — mesmo que o modelo não bata o o3 em qualidade, pagar 5% do preço por 80% da performance já é um bom negócio.

Inteligência × preço de saída
Mistral Large 3 2512o3Claude Haiku 4.5gpt-oss-120bUS$ por milhão (saída, escala log)índice de inteligência

Não muda nada para quem já está no gpt-oss-120b ou em modelos open-source de peso similar. O Speciale é fechado, e o ganho de raciocínio precisa aparecer em benchmark antes de justificar troca. Também não muda nada para quem usa o V3.2 base: o Speciale é um complemento, não um substituto.

O que falta saber

O índice de inteligência, o score de código e a nota agentic não foram publicados hoje. Enquanto não aparecerem, o Speciale é uma promessa de preço — não uma promessa de capacidade. A DeepSeek já mostrou que consegue entregar modelos competitivos a custo baixo. A questão é se o raciocínio do Speciale acompanha o marketing, ou se o preço baixo veio acompanhado de um cérebro mais simples.

Se você está decidindo agora, a jogada é clara: rode um piloto controlado com seu caso de uso real, meça qualidade por tarefa e compare o custo total com o que paga hoje. O preço de tabela é convidativo, mas o que importa é o custo por tarefa bem resolvida.

Em uma frase

Se você paga o3 ou Claude Haiku 4.5 em volume, o V3.2 Speciale justifica um piloto hoje — mas espere o índice de inteligência aparecer antes de migrar produção.

Perguntas frequentes

DeepSeek V3.2 Speciale é melhor que o o3?

Não dá para saber ainda. O catálogo não publicou índice de inteligência, benchmark de código nem score agentic para o Speciale. O preço é 18 vezes menor que o o3 na saída, mas a qualidade do raciocínio precisa ser medida antes de qualquer conclusão.

Qual a diferença entre DeepSeek V3.2 e V3.2 Speciale?

O V3.2 base custa US$ 0,40 por milhão de tokens de saída; o Speciale custa US$ 0,43. A diferença está no pós-treinamento: o Speciale foi reforçado com reinforcement learning para raciocínio máximo e tarefas agentic, enquanto o V3.2 base mantém o perfil de uso geral.

Vale trocar o Claude Haiku 4.5 pelo DeepSeek V3.2 Speciale?

Depende do caso. O Speciale é mais de 11 vezes mais barato na saída, mas o Claude Haiku 4.5 tem IQ 29,892 no catálogo — e o Speciale não tem nota publicada. Para cargas agentic de alto volume, o piloto compensa; para tarefas onde a qualidade do raciocínio é crítica, espere benchmarks.

Leia também