FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

DeepSeek V3.1 Terminus chega sem índice de inteligência e cobra US$ 1 por milhão de saída

Update incremental do V3.1 corrige idioma e agente, mas o catálogo não publicou nota de IQ — então a pergunta é contra quem ele compete de verdade.

Redação FalaVIP IA 3 min de leitura
US$ 0,27por milhão de tokens de entrada
US$ 1,00por milhão de tokens de saída
US$ 0,135por milhão de tokens em cache

Você viu o lançamento, viu o preço e provavelmente fez a mesma conta: US$ 0,27 para entrar, US$ 1 para sair. É barato perto do o3 — que custa oito dólares por milhão de tokens de saída, quase o triplo do cache do Terminus somado ao input. Só que existe um problema que o release da DeepSeek não resolve para você: o catálogo não publicou índice de inteligência, nota de coding, agentic nem blended para esse modelo. Você está decidindo às cegas no quesito que mais importa quando o assunto é trocar de fornecedor.

O que a Terminus mudou em relação ao V3.1

A descrição oficial trata o Terminus como um update do V3.1 original, não como uma nova geração. A própria DeepSeek diz que mantém as capacidades anteriores e foi atrás dos problemas reportados pelos usuários. Os dois pontos citados são consistência de idioma — o velho defeito de modelos chineses que misturam inglês no meio de resposta em português — e capacidade agente. Não há menção a expansão de contexto, novo conhecimento de corte nem mudança de arquitetura que justifique migrar de um fork de fronteira para outro.

A janela de contexto segue em 163.840 tokens, número idêntico ao do V3.1. O knowledge cutoff é 31 de março de 2025. Em outras palavras: do ponto de vista de quem opera um pipeline de produção, nada estrutural mudou. Você está comprando um patch comportamental, não um salto de capacidade.

Preço: onde ele vence e onde ele perde

A conta que interessa para quem paga API é custo de uma tarefa completa, não só o token de saída. Em input a US$ 0,27 por milhão, o Terminus cobra menos que o Llama 4 Maverick listado no topo do catálogo hoje, e está no mesmo balizador de modelos abertos do tier intermediário. Em cache, US$ 0,135 por milhão é metade do preço de entrada — é a vantagem que importa para produto com prompt grande reutilizado: RAG com system prompt pesado, agentes que repetem contexto a cada turno, chatbots com instruções longas.

Onde ele perde feio é na comparação com o topo da tabela. O o3 cobra US$ 8 por milhão de saída e tem IQ 31,096. O gpt-oss-120b, da própria OpenAI, cobra US$ 0,17 e tem IQ 24,126 — quatro vezes mais barato na saída que o Terminus e quase oito pontos a mais de índice. O Qwen3 Next 80B A3B Thinking cobra US$ 1,20 por milhão de saída, comparável ao Terminus, e marca IQ 16,867.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 231 modelos disponíveis no catálogo nesta data.

Sem nota de IQ publicada, a comparação justa vira chute. Você só consegue comparar Terminus com V3.1 antigo, não com a concorrência.

Para quem vale trocar

Vale trocar se você já roda V3.1 e estava sofrendo com mistura de idioma em português ou com o agente engasgando em tool calls longas. Como o preço é o mesmo do V3.1 anterior, não há custo extra — é um upgrade gratuito dentro da mesma linha. Para produto final em PT-BR com fluxos agentes de duas ou três chamadas, é a correção que faltava.

Vale considerar se você precisa de cache barato com contexto de 160k e o Llama 4 Maverick (US$ 0,696 por milhão de saída) não estiver entregando a qualidade de código que o seu time precisa. Terminus entra como segunda opção barata para prompts longos reusados.

Para quem NÃO muda nada

Se o seu gargalo é raciocínio — matemática, código complexo, planejamento multi-etapa — o o3 continua em outro patamar de IQ, e o gpt-oss-120b entrega mais inteligência por menos da metade do preço da saída do Terminus. O catálogo tem hoje 231 modelos listados, 39 criadores e 16 lançamentos nos últimos 30 dias; este é só mais um, sem nota que permita ranqueamento.

Se você já usa GPT-OSS-20B para tarefas simples, não há motivo de mexer: a diferença comportamental entre dois modelos chineses intermediários raramente justifica refazer pipeline.

Ficha técnica — DeepSeek V3.1 Terminus
CampoValor
Identificadordeepseek/deepseek-v3.1-terminus
Criadordeepseek
Preço de entradaUS$ 0.270 / M tokens
Preço de saídaUS$ 1.00 / M tokens
Janela de contexto164k
Modalidadetext->text
Leitura de cacheUS$ 0.135 / M (50% de desconto)

O tabuleiro hoje

A Terminus chega no mesmo dia em que o o3 lidera com IQ 31 e US$ 8 por milhão de saída, o gpt-oss-120b segura a faixa de US$ 0,17 com IQ 24, e o Qwen3 Thinking ocupa o espaço de modelo de raciocínio a US$ 1,20. A DeepSeek entra sem nota de inteligência — e essa é a informação que falta para você decidir. O release fala em correção; o catálogo ainda não mediu. Enquanto a nota não sai, o Terminus é compra de continuidade, não de upgrade.

Em uma frase

Só troque do V3.1 antigo se mistura de idioma ou falhas de agente estavam te custando dinheiro; para tarefas de raciocínio, o gpt-oss-120b entrega mais por menos da metade do preço.

Perguntas frequentes

DeepSeek V3.1 Terminus tem índice de inteligência?

Não. O catálogo não publicou nota de IQ, coding, agentic nem blended para este modelo no dia do lançamento. Você só pode comparar Terminus com a versão anterior, não com a concorrência.

Quanto custa a API do DeepSeek V3.1 Terminus?

US$ 0,27 por milhão de tokens de entrada, US$ 1,00 por milhão de tokens de saída e US$ 0,135 por milhão de tokens em cache. É o mesmo preço do V3.1 original — o update não mudou a tabela.

Terminus ou gpt-oss-120b: qual escolher?

Se o gargalo for raciocínio, o gpt-oss-120b tem IQ 24,126 publicado e custa US$ 0,17 por milhão de saída — quase seis vezes mais barato na saída. Terminus só leva a melhor quando você já estava no ecossistema DeepSeek e precisava do patch de idioma.

Leia também