DeepSeek V3.1 Terminus chega sem índice de inteligência e cobra US$ 1 por milhão de saída
Update incremental do V3.1 corrige idioma e agente, mas o catálogo não publicou nota de IQ — então a pergunta é contra quem ele compete de verdade.
Você viu o lançamento, viu o preço e provavelmente fez a mesma conta: US$ 0,27 para entrar, US$ 1 para sair. É barato perto do o3 — que custa oito dólares por milhão de tokens de saída, quase o triplo do cache do Terminus somado ao input. Só que existe um problema que o release da DeepSeek não resolve para você: o catálogo não publicou índice de inteligência, nota de coding, agentic nem blended para esse modelo. Você está decidindo às cegas no quesito que mais importa quando o assunto é trocar de fornecedor.
O que a Terminus mudou em relação ao V3.1
A descrição oficial trata o Terminus como um update do V3.1 original, não como uma nova geração. A própria DeepSeek diz que mantém as capacidades anteriores e foi atrás dos problemas reportados pelos usuários. Os dois pontos citados são consistência de idioma — o velho defeito de modelos chineses que misturam inglês no meio de resposta em português — e capacidade agente. Não há menção a expansão de contexto, novo conhecimento de corte nem mudança de arquitetura que justifique migrar de um fork de fronteira para outro.
A janela de contexto segue em 163.840 tokens, número idêntico ao do V3.1. O knowledge cutoff é 31 de março de 2025. Em outras palavras: do ponto de vista de quem opera um pipeline de produção, nada estrutural mudou. Você está comprando um patch comportamental, não um salto de capacidade.
Preço: onde ele vence e onde ele perde
A conta que interessa para quem paga API é custo de uma tarefa completa, não só o token de saída. Em input a US$ 0,27 por milhão, o Terminus cobra menos que o Llama 4 Maverick listado no topo do catálogo hoje, e está no mesmo balizador de modelos abertos do tier intermediário. Em cache, US$ 0,135 por milhão é metade do preço de entrada — é a vantagem que importa para produto com prompt grande reutilizado: RAG com system prompt pesado, agentes que repetem contexto a cada turno, chatbots com instruções longas.
Onde ele perde feio é na comparação com o topo da tabela. O o3 cobra US$ 8 por milhão de saída e tem IQ 31,096. O gpt-oss-120b, da própria OpenAI, cobra US$ 0,17 e tem IQ 24,126 — quatro vezes mais barato na saída que o Terminus e quase oito pontos a mais de índice. O Qwen3 Next 80B A3B Thinking cobra US$ 1,20 por milhão de saída, comparável ao Terminus, e marca IQ 16,867.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Sem nota de IQ publicada, a comparação justa vira chute. Você só consegue comparar Terminus com V3.1 antigo, não com a concorrência.
Para quem vale trocar
Vale trocar se você já roda V3.1 e estava sofrendo com mistura de idioma em português ou com o agente engasgando em tool calls longas. Como o preço é o mesmo do V3.1 anterior, não há custo extra — é um upgrade gratuito dentro da mesma linha. Para produto final em PT-BR com fluxos agentes de duas ou três chamadas, é a correção que faltava.
Vale considerar se você precisa de cache barato com contexto de 160k e o Llama 4 Maverick (US$ 0,696 por milhão de saída) não estiver entregando a qualidade de código que o seu time precisa. Terminus entra como segunda opção barata para prompts longos reusados.
Para quem NÃO muda nada
Se o seu gargalo é raciocínio — matemática, código complexo, planejamento multi-etapa — o o3 continua em outro patamar de IQ, e o gpt-oss-120b entrega mais inteligência por menos da metade do preço da saída do Terminus. O catálogo tem hoje 231 modelos listados, 39 criadores e 16 lançamentos nos últimos 30 dias; este é só mais um, sem nota que permita ranqueamento.
Se você já usa GPT-OSS-20B para tarefas simples, não há motivo de mexer: a diferença comportamental entre dois modelos chineses intermediários raramente justifica refazer pipeline.
| Campo | Valor |
|---|---|
| Identificador | deepseek/deepseek-v3.1-terminus |
| Criador | deepseek |
| Preço de entrada | US$ 0.270 / M tokens |
| Preço de saída | US$ 1.00 / M tokens |
| Janela de contexto | 164k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.135 / M (50% de desconto) |
O tabuleiro hoje
A Terminus chega no mesmo dia em que o o3 lidera com IQ 31 e US$ 8 por milhão de saída, o gpt-oss-120b segura a faixa de US$ 0,17 com IQ 24, e o Qwen3 Thinking ocupa o espaço de modelo de raciocínio a US$ 1,20. A DeepSeek entra sem nota de inteligência — e essa é a informação que falta para você decidir. O release fala em correção; o catálogo ainda não mediu. Enquanto a nota não sai, o Terminus é compra de continuidade, não de upgrade.
Só troque do V3.1 antigo se mistura de idioma ou falhas de agente estavam te custando dinheiro; para tarefas de raciocínio, o gpt-oss-120b entrega mais por menos da metade do preço.
Perguntas frequentes
DeepSeek V3.1 Terminus tem índice de inteligência?
Não. O catálogo não publicou nota de IQ, coding, agentic nem blended para este modelo no dia do lançamento. Você só pode comparar Terminus com a versão anterior, não com a concorrência.
Quanto custa a API do DeepSeek V3.1 Terminus?
US$ 0,27 por milhão de tokens de entrada, US$ 1,00 por milhão de tokens de saída e US$ 0,135 por milhão de tokens em cache. É o mesmo preço do V3.1 original — o update não mudou a tabela.
Terminus ou gpt-oss-120b: qual escolher?
Se o gargalo for raciocínio, o gpt-oss-120b tem IQ 24,126 publicado e custa US$ 0,17 por milhão de saída — quase seis vezes mais barato na saída. Terminus só leva a melhor quando você já estava no ecossistema DeepSeek e precisava do patch de idioma.