DeepSeek V3.1 Terminus entra a US$ 1/milhão e sem benchmark novo
Update da DeepSeek mantém preço do V3.1 e corrige consistência de idioma e agentes, mas catálogo não publicou índice de inteligência para comparar.
O catálogo fechou a segunda-feira (22) com 231 modelos listados, 16 deles lançados nos últimos 30 dias. A entrada do dia não é uma geração nova: é um update. A DeepSeek colocou no ar o V3.1 Terminus, descrito pela própria empresa como uma revisão do V3.1 que mantém as capacidades originais e ataca dois problemas reportados por usuários — consistência de idioma e capacidades agentic. Para quem paga a API, a pergunta de ouro é: mudou a fatura?
Não mudou. O V3.1 Terminus entra a US$ 0,27 por milhão de tokens de entrada, US$ 1 por milhão de saída e US$ 0,135 por milhão em cache. Mesma tabela de preços do V3.1 que já circulava. A janela de contexto segue em 163.840 tokens, e o corte de conhecimento é março de 2025.
| Campo | Valor |
|---|---|
| Identificador | deepseek/deepseek-v3.1-terminus |
| Criador | deepseek |
| Preço de entrada | US$ 0.270 / M tokens |
| Preço de saída | US$ 1.00 / M tokens |
| Janela de contexto | 164k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.135 / M (50% de desconto) |
O que o "update" realmente diz
Releases com nome de "terminus" costumam virar sinônimo de "renumerei para parecer novo". Não é o caso aqui. A descrição do catálogo lista dois problemas específicos que a DeepSeek diz ter endereçado: consistência de idioma — o modelo parar de despejar trechos em chinês no meio de uma resposta em inglês, ou trocar de registro sem aviso — e capacidades agentic, a capacidade de seguir cadeias de ferramentas e instruções longas sem perder o fio ou alucinar o próximo passo.
Se você já rodava V3.1 em produção e tinha alguma dessas duas dores, o Terminus é, na prática, um patch. Se você não tinha, não há motivo racional para trocar — até porque falta o segundo ingrediente para decidir.
O buraco no meio: sem benchmark
Aqui está o ponto que nenhum comunicado vai soltar: o V3.1 Terminus entrou no catálogo sem nota de inteligência publicada. O índice da Artificial Analysis não tem valor; coding, agentic, blended, reasoning e omniscience estão vazios. Em outras palavras, não dá para colocar o Terminus no gráfico de "inteligência por dólar" ao lado dos rivais e dizer se a conta fecha melhor ou pior que antes.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| DeepSeek V3.1 Terminus (o novo) | — | 0.27 | 1 | 164k |
| o3 | 31.1 | 2 | 8 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Qwen3 Next 80B A3B Thinking | 16.9 | 0.15 | 1.2 | 262k |
A DeepSeek não publicou. Pode ser foco em tarefas específicas que não entram no índice geral; pode ser benchmark que ainda nem rodou. O fato concreto é: hoje, quem precisa comparar números para escolher modelo está no escuro sobre o Terminus.
O tabuleiro de preços
Olhando só o preço de saída, o Terminus cai num ponto incomum: US$ 1 por milhão é praticamente o mesmo que a chinesa Qwen (grupo Alibaba) cobra pelo Qwen3 Next 80B A3B Thinking, a US$ 1,20 — e que tem índice de inteligência 16,867 medido. É um patamar de mercado onde o concorrente direto é um modelo de peso aberto, chinês e barato.
Para referência: o o3 da OpenAI, que lidera o índice de inteligência em 31,096, custa US$ 8 por milhão de tokens de saída — oito vezes mais caro. Já o gpt-oss-120b, também da OpenAI, sai a US$ 0,17 por milhão (índice 24,126) — quase seis vezes mais barato que o Terminus e com nota medida no catálogo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Para quem vale, e para quem não muda nada
Vale para quem roda V3.1 e sentiu as dores descritas — mistura de idioma em produto bilíngue, agentes que perdem o fio em chains longas. A troca é de patch, não de migração.
Não vale para quem compra por benchmark. Sem nota de inteligência no catálogo, comparar o Terminus com Qwen, gpt-oss-120b ou o3 é comparar no escuro. Quem está decidindo modelo novo hoje, com índice medido, tem o gpt-oss-120b a US$ 0,17 saindo na frente em custo-benefício, e o o3 na frente em capacidade bruta.
Também não muda nada para quem já está no o3 ou em outra família de ponta: o preço é competitivo, mas o argumento "mais barato" só convence se a qualidade medida for próxima. E essa medida, por ora, não existe.
O que fazer com isso
Se você roda V3.1: troque, rode a suíte de testes do seu próprio produto, e meça. O catálogo não vai medir por você.
Se você está escolhendo modelo do zero: mantenha o Terminus no radar, mas não feche contrato esperando benchmark de terceiros. Espere uma semana, ou faça o seu próprio benchmark antes de migrar produção.
Troque se você já usava V3.1 e sofria com mistura de idioma ou agentes inconsistentes; quem escolhe modelo do zero deve esperar o índice de inteligência aparecer antes de migrar.
Perguntas frequentes
O DeepSeek V3.1 Terminus é um modelo novo ou uma atualização?
É uma atualização do V3.1. A própria DeepSeek descreve como um update que mantém as capacidades originais e corrige consistência de idioma e capacidades agentic reportadas por usuários.
Quanto custa o DeepSeek V3.1 Terminus?
US$ 0,27 por milhão de tokens de entrada, US$ 1 por milhão de saída e US$ 0,135 por milhão em cache. Os preços são os mesmos do V3.1 anterior.
O DeepSeek V3.1 Terminus tem benchmark publicado?
Não. No catálogo, os índices de inteligência, coding, agentic, blended, reasoning e omniscience estão vazios para este modelo, então não é possível compará-lo numericamente com os rivais nesta data.