FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Cogito v2.1 671B a US$ 1,25/M: o que o marketing não entrega

O catálogo não publicou índice de inteligência para o modelo. O preço, simétrico e abaixo do Haiku 4.5 e do o3, já está tabelado.

Redação FalaVIP IA 3 min de leitura
US$ 1,25por milhão de tokens, entrada e saída
0nota de inteligência publicada no catálogo
7,4xmais caro na saída que o gpt-oss-120b

US$ 1,25 por milhão de tokens, nos dois lados. Esse é o preço que a Deep Cogito fixou nesta quinta (13) para o Cogito v2.1 671B, um modelo de 671 bilhões de parâmetros anunciado como "um dos modelos abertos mais fortes do mundo", treinado com self play e aprendizado por reforço. Só tem um problema: a nota de inteligência que diz se essa frase bate com a realidade ainda não entrou no catálogo.

O que está na ficha — e o que não está

O que dá para checar agora é o seguinte. O Cogito v2.1 671B é uma mistura de especialistas (MoE), com janela de 128 mil tokens, modalidade exclusivamente texto-em-texto, e preço simétrico de US$ 1,25 por milhão tanto na entrada quanto na saída. Não é gratuito. O catálogo mantém mais de 276 modelos hoje, vindos de 42 criadores, e este é o vigésimo lançamento dos últimos 30 dias.

Ficha técnica — Cogito v2.1 671B
CampoValor
Identificadordeepcogito/cogito-v2.1-671b
Criadordeepcogito
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 1.25 / M tokens
Janela de contexto128k
Modalidadetext->text

Fora isso, há lacunas. O índice de inteligência é nulo. As notas de coding e agentic também. Não há registro de open_weights nem de país de origem no catálogo. A promessa de "matching frontier" ainda é só release até alguém medir.

A conta de preço, finalmente

Onde o Cogito v2.1 se posiciona é mais fácil de ver. A US$ 1,25 por milhão de tokens de saída, ele custa quatro vezes menos que o Claude Haiku 4.5 (US$ 5/M) e pouco mais de seis vezes menos que o o3 da OpenAI (US$ 8/M). Mas não é o modelo aberto mais barato: o gpt-oss-120b da própria OpenAI está tabelado a US$ 0,17/M de saída — cerca de sete vezes mais em conta.

Preço de saída (US$ por milhão de tokens)
Cogito v2.1 671B1,25o38Claude Haiku 4.55gpt-oss-120b0,17US$/M
Fonte: OpenRouter

Se você roda muito volume e o gargalo é custo por token, o Cogito v2.1 entra como mais uma opção na faixa intermediária — não a mais barata, mas com argumento de capacidade maior. Se o que importa é simplesmente o menor preço por token, o gpt-oss-120b segue imbatível nesta data.

O que ainda não dá para comparar

Para quase todos os modelos que disputam o topo da tabela hoje, o índice de inteligência Artificial Analysis está publicado: o3 marca 31,1, Claude Haiku 4.5 marca 29,9, gpt-oss-120b marca 24,1. O Cogito v2.1 não tem nota — então não dá para colocá-lo no gráfico de custo-benefício junto dos outros. E, sem nota, "igualar fronteira" vira declaração de release, não fato verificável.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Cogito v2.1 671B (o novo)1.251.25128k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O preço de US$ 1,25/M é honesto: é menor que o dos rivais fechados, maior que o do rival aberto da OpenAI. A pergunta que fica é o que esse MoE de 671B entrega em raciocínio, código e uso como agente. Sem benchmark independente, a resposta é: não sabemos ainda.

Para quem muda a conta, e para quem não muda nada

Se o seu pipeline já roda em modelos como Haiku 4.5 ou o3 e o custo está apertando, o Cogito v2.1 entra na lista de testes. Vale rodar workloads reais — geração longa, sumarização, extração — antes de trocar de fornecedor, e o preço ajuda a justificar a experimentação.

Se você precisa de benchmark reproduzível para defender a escolha em uma reunião, ou se sua régua é performance em código e agente medida por suíte pública, mantenha o pé atrás. Não refatore pipeline em torno de um modelo cuja nota de inteligência ainda não existe.

O que fazer com isso hoje

Três movimentos práticos. Primeiro, ponha o Cogito v2.1 na fila de testes com a mesma régua que você usa para Haiku 4.5 e gpt-oss-120b — seu caso de uso, seu custo, seu output. Segundo, não abandone o plano B: o gpt-oss-120b continua sendo a opção de menor preço, e o Haiku 4.5 segue como a referência fechada de melhor custo até segunda ordem. Terceiro, volte aqui quando a nota de inteligência for publicada. Até lá, é preço certo e performance por provar.

Em uma frase

Por US$ 1,25/M, vale rodar o Cogito v2.1 no seu workload real antes de trocar de modelo — mas não refatore pipeline em torno dele até o índice de inteligência aparecer.

Perguntas frequentes

Cogito v2.1 671B é melhor que o Claude Haiku 4.5?

O catálogo não tem nota de inteligência para o Cogito v2.1. O comunicado da Deep Cogito diz que o modelo "iguala a fronteira", mas isso ainda é marketing. Até um benchmark independente aparecer, a comparação não passa de promessa.

Quanto custa o Cogito v2.1 671B?

US$ 1,25 por milhão de tokens, tanto na entrada quanto na saída — preço simétrico. É quatro vezes mais barato que o Claude Haiku 4.5 (US$ 5/M de saída) e pouco mais de seis vezes mais barato que o o3 (US$ 8/M), mas cerca de sete vezes mais caro que o gpt-oss-120b (US$ 0,17/M).

O Cogito v2.1 é open source mesmo?

A descrição do criador chama o Cogito v2.1 de "um dos modelos abertos mais fortes do mundo", mas o catálogo não traz o campo open_weights preenchido. Para confirmar a licença dos pesos, é preciso checar os canais oficiais da Deep Cogito.

Leia também