Nex AGI solta modelo de 397B grátis, mas IQ não entra no top 5
Versão gratuita do Nex-N2-Pro traz pesos abertos, multimodal e a maior nota de coding entre pesos abertos recentes. Para o topo de inteligência, o caminho segue em Gemini 3.1 Pro e GPT-5.3-Codex.
Você já viu esse filme: modelo chinês com peso aberto, gratuito no catálogo, e a manchete prometendo "concorrência de peso". O Nex-N2-Pro, da Nex AGI, chegou hoje (8 de junho) ao catálogo com três variantes — uma gratuita como carro-chefe, outra paga a US$ 0,25 de entrada e US$ 1,00 de saída por milhão de tokens, e uma terceira também free. O catálogo soma mais de 462 modelos ativos, vindos de 61 criadores diferentes, e 21 lançamentos só nos últimos 30 dias. A pergunta que importa: o Nex-N2-Pro muda alguma coisa na sua pilha?
O pacote de hoje
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Nex-N2-Pro (free) | 0 | 0 | 262k |
| Nex-N2-Pro | 0.25 | 1 | 262k |
A Nex AGI não economizou no vocabulário. O Nex-N2-Pro é apresentado como mixture-of-experts: 397 bilhões de parâmetros totais, mas só 17 bilhões ativos por inferência. A base é a arquitetura Qwen3.5, o que coloca o modelo na mesma família técnica de outros pesos abertos chineses recentes. Contexto de 262 mil tokens, entrada de texto e imagem, saída em texto, modo raciocínio ligado e pesos abertos para quem quiser baixar.
O tamanho não é tudo
O número de 397B chama atenção, mas é MoE — só 17B são ativados por token. É como ter um restaurante com 397 lugares no salão, mas a cozinha só prepara 17 pratos por vez. O que importa mesmo é a nota de inteligência, e aqui a história é mais modesta.
O Nex-N2-Pro marca 41,7 no índice do catálogo. O topo do dia é do Gemini 3.1 Pro Preview, com 47,7 — 6 pontos acima. Atrás do líder, MiniMax M3 (45,4), DeepSeek V4 Pro 0423 (45,3) e o Gemini 3.5 Flash (46,7) também passam o Nex. Em benchmarks agregados, esses pontos costumam se traduzir em diferença visível nas respostas, especialmente em raciocínio encadeado e interpretação de texto longo.
Onde ele brilha e onde ele perde
Tem um lugar onde o modelo da Nex AGI se destaca: coding, com nota 59,1, a maior do conjunto de dados que veio junto com o lançamento. Comparado ao Gemini 3.1 Pro Preview, que lidera em inteligência geral, o Nex-N2-Pro fica à frente nesse recorte específico de programação — útil para quem roda geração de código em volume.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Nex-N2-Pro (free) (o novo) | 41.7 | 0 | 0 | 262k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| Gemini 3.5 Flash | 46.7 | 1.5 | 9 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
A pontuação agentic, por outro lado, é de 31,2 — mais baixa que a de coding, e abaixo da média dos modelos top. Para fluxos autônomos longos, com múltiplas chamadas de ferramenta, o ganho em coding pode não compensar a perda em raciocínio agentivo.
Para quem vale a pena (e para quem não muda nada)
Faz sentido olhar agora se você roda tarefa de coding com orçamento curto. A versão paga, a US$ 1,00 por milhão de tokens de saída, é mais barata que o DeepSeek V4 Pro (US$ 1,74), que o MiniMax M3 (US$ 1,20) e muito mais barata que o GPT-5.3-Codex (US$ 14). A versão gratuita zera a conta — útil para prototipagem e testes de prompt antes de partir para a paga. Pesos abertos também entram na conta: se você mantém inferência própria ou precisa de soberania de dados, é mais um MoE aberto para a prateleira, ao lado de MiniMax M3 e DeepSeek V4 Pro.
Não muda nada se o seu gargalo é inteligência bruta — síntese longa, raciocínio multi-etapa, perguntas abertas. O caminho continua passando por Gemini 3.1 Pro Preview ou GPT-5.3-Codex, mesmo pagando mais caro. Para agentic pesado, o 31,2 do Nex-N2-Pro é um alerta: o modelo pode engasgar em cadeias longas de ferramenta.
O que fazer agora
Se você já tem MiniMax M3 ou DeepSeek V4 Pro na pilha, o Nex-N2-Pro é mais uma opção na prateleira chinesa de MoE aberto — vale testar em coding puro pela nota, mas não substitui o topo em raciocínio geral. Se você não usa nenhum modelo gratuito com peso aberto, esta é uma boa porta de entrada: grátis no catálogo, aberto para download, multimodal e com a maior nota de coding entre os pesos abertos recentes. A escolha continua sendo sobre o que você troca. No Nex-N2-Pro, você troca IQ de topo por preço zero (ou quase) e por um extra de programação.
Se coding é seu gargalo e o orçamento aperta, teste o Nex-N2-Pro gratuito ou pago a US$ 1,00/M; se você precisa de inteligência geral no topo, siga em Gemini 3.1 Pro Preview ou GPT-5.3-Codex.
Perguntas frequentes
O Nex-N2-Pro é gratuito mesmo?
Sim, a Nex AGI publicou uma versão free no catálogo, que está como carro-chefe do lançamento. A versão paga custa US$ 0,25 por milhão de tokens de entrada e US$ 1,00 por milhão de tokens de saída.
O que significa 397B parâmetros com só 17B ativos?
O modelo é mixture-of-experts: cada token é roteado para um subconjunto dos especialistas. Em inferência, só 17 bilhões de parâmetros são processados por vez, o que reduz custo de compute sem perder o tamanho total do modelo.
Nex-N2-Pro substitui o Gemini 3.1 Pro Preview?
Não no recorte de inteligência geral — o Nex marca 41,7 contra 47,7 do Gemini 3.1 Pro. Em coding o Nex fica à frente (59,1), mas em agentic o Gemini segue na frente, então a troca só compensa se o seu gargalo for programação pura.