FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Nex AGI solta modelo de 397B grátis, mas IQ não entra no top 5

Versão gratuita do Nex-N2-Pro traz pesos abertos, multimodal e a maior nota de coding entre pesos abertos recentes. Para o topo de inteligência, o caminho segue em Gemini 3.1 Pro e GPT-5.3-Codex.

Redação FalaVIP IA 3 min de leitura
US$ 1,00por milhão de tokens de saída na versão paga
41,7de índice de inteligência, 6 pontos abaixo do líder do dia
59,1em coding — a maior nota entre os pesos abertos do lançamento

Você já viu esse filme: modelo chinês com peso aberto, gratuito no catálogo, e a manchete prometendo "concorrência de peso". O Nex-N2-Pro, da Nex AGI, chegou hoje (8 de junho) ao catálogo com três variantes — uma gratuita como carro-chefe, outra paga a US$ 0,25 de entrada e US$ 1,00 de saída por milhão de tokens, e uma terceira também free. O catálogo soma mais de 462 modelos ativos, vindos de 61 criadores diferentes, e 21 lançamentos só nos últimos 30 dias. A pergunta que importa: o Nex-N2-Pro muda alguma coisa na sua pilha?

O pacote de hoje

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Nex-N2-Pro (free)00262k
Nex-N2-Pro0.251262k

A Nex AGI não economizou no vocabulário. O Nex-N2-Pro é apresentado como mixture-of-experts: 397 bilhões de parâmetros totais, mas só 17 bilhões ativos por inferência. A base é a arquitetura Qwen3.5, o que coloca o modelo na mesma família técnica de outros pesos abertos chineses recentes. Contexto de 262 mil tokens, entrada de texto e imagem, saída em texto, modo raciocínio ligado e pesos abertos para quem quiser baixar.

O tamanho não é tudo

O número de 397B chama atenção, mas é MoE — só 17B são ativados por token. É como ter um restaurante com 397 lugares no salão, mas a cozinha só prepara 17 pratos por vez. O que importa mesmo é a nota de inteligência, e aqui a história é mais modesta.

Índice de inteligência (Artificial Analysis)
Nex-N2-Pro (free)41,7Gemini 3.1 Pro Preview47,7Gemini 3.5 Flash46,7GPT-5.3-Codex45,5MiniMax M345,4DeepSeek V4 Pro 042345,3índice
Fonte: Artificial Analysis

O Nex-N2-Pro marca 41,7 no índice do catálogo. O topo do dia é do Gemini 3.1 Pro Preview, com 47,7 — 6 pontos acima. Atrás do líder, MiniMax M3 (45,4), DeepSeek V4 Pro 0423 (45,3) e o Gemini 3.5 Flash (46,7) também passam o Nex. Em benchmarks agregados, esses pontos costumam se traduzir em diferença visível nas respostas, especialmente em raciocínio encadeado e interpretação de texto longo.

Onde ele brilha e onde ele perde

Tem um lugar onde o modelo da Nex AGI se destaca: coding, com nota 59,1, a maior do conjunto de dados que veio junto com o lançamento. Comparado ao Gemini 3.1 Pro Preview, que lidera em inteligência geral, o Nex-N2-Pro fica à frente nesse recorte específico de programação — útil para quem roda geração de código em volume.

Inteligência × preço de saída
Gemini 3.1 Pro PreviewGemini 3.5 FlashGPT-5.3-CodexMiniMax M3DeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Nex-N2-Pro (free) (o novo)41.700262k
Gemini 3.1 Pro Preview47.72121.05M
Gemini 3.5 Flash46.71.591.05M
GPT-5.3-Codex45.51.7514400k
MiniMax M345.40.31.21.05M
DeepSeek V4 Pro 042345.31.04232.08451.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A pontuação agentic, por outro lado, é de 31,2 — mais baixa que a de coding, e abaixo da média dos modelos top. Para fluxos autônomos longos, com múltiplas chamadas de ferramenta, o ganho em coding pode não compensar a perda em raciocínio agentivo.

Para quem vale a pena (e para quem não muda nada)

Faz sentido olhar agora se você roda tarefa de coding com orçamento curto. A versão paga, a US$ 1,00 por milhão de tokens de saída, é mais barata que o DeepSeek V4 Pro (US$ 1,74), que o MiniMax M3 (US$ 1,20) e muito mais barata que o GPT-5.3-Codex (US$ 14). A versão gratuita zera a conta — útil para prototipagem e testes de prompt antes de partir para a paga. Pesos abertos também entram na conta: se você mantém inferência própria ou precisa de soberania de dados, é mais um MoE aberto para a prateleira, ao lado de MiniMax M3 e DeepSeek V4 Pro.

Não muda nada se o seu gargalo é inteligência bruta — síntese longa, raciocínio multi-etapa, perguntas abertas. O caminho continua passando por Gemini 3.1 Pro Preview ou GPT-5.3-Codex, mesmo pagando mais caro. Para agentic pesado, o 31,2 do Nex-N2-Pro é um alerta: o modelo pode engasgar em cadeias longas de ferramenta.

O que fazer agora

Se você já tem MiniMax M3 ou DeepSeek V4 Pro na pilha, o Nex-N2-Pro é mais uma opção na prateleira chinesa de MoE aberto — vale testar em coding puro pela nota, mas não substitui o topo em raciocínio geral. Se você não usa nenhum modelo gratuito com peso aberto, esta é uma boa porta de entrada: grátis no catálogo, aberto para download, multimodal e com a maior nota de coding entre os pesos abertos recentes. A escolha continua sendo sobre o que você troca. No Nex-N2-Pro, você troca IQ de topo por preço zero (ou quase) e por um extra de programação.

Em uma frase

Se coding é seu gargalo e o orçamento aperta, teste o Nex-N2-Pro gratuito ou pago a US$ 1,00/M; se você precisa de inteligência geral no topo, siga em Gemini 3.1 Pro Preview ou GPT-5.3-Codex.

Perguntas frequentes

O Nex-N2-Pro é gratuito mesmo?

Sim, a Nex AGI publicou uma versão free no catálogo, que está como carro-chefe do lançamento. A versão paga custa US$ 0,25 por milhão de tokens de entrada e US$ 1,00 por milhão de tokens de saída.

O que significa 397B parâmetros com só 17B ativos?

O modelo é mixture-of-experts: cada token é roteado para um subconjunto dos especialistas. Em inferência, só 17 bilhões de parâmetros são processados por vez, o que reduz custo de compute sem perder o tamanho total do modelo.

Nex-N2-Pro substitui o Gemini 3.1 Pro Preview?

Não no recorte de inteligência geral — o Nex marca 41,7 contra 47,7 do Gemini 3.1 Pro. Em coding o Nex fica à frente (59,1), mas em agentic o Gemini segue na frente, então a troca só compensa se o seu gargalo for programação pura.

Leia também