FalaVIP IA o que os modelos custam,
medido todo dia
Lançamentos

Nex-N2.5 Mini e Pro chegam grátis com 262 mil tokens

Os dois modelos da Nex AGI aparecem no OpenRouter com custo zero de entrada e saída. O contexto é amplo, mas não há notas públicas de inteligência, código ou uso agêntico para justificar uma troca imediata em produção.

Redação FalaVIP IA 3 min de leitura
US$ 0por milhão de tokens de entrada e saída no OpenRouter
262.144tokens de janela de contexto para cada modelo
585modelos disponíveis no catálogo do OpenRouter

A Nex AGI colocou dois modelos no catálogo do OpenRouter sem cobrança por tokens: o Nex-N2.5-Mini e o Nex-N2.5-Pro. Ambos aparecem com preço de US$ 0 por milhão de tokens de entrada e de saída e janela de contexto de 262.144 tokens.

Para quem paga a conta da API, a notícia é direta: dá para testar os dois sem acrescentar custo de inferência à fatura. A parte menos óbvia é que contexto grande e preço zero não informam, sozinhos, se o modelo aguenta uma aplicação crítica.

O que realmente mudou

Os dois modelos foram lançados em 8 de setembro e estreiam no catálogo com o sufixo :free. No OpenRouter, o Nex-N2.5-Mini e o Nex-N2.5-Pro estão listados com custo zero tanto para entrada quanto para saída.

Isso muda a barreira de teste. Você pode conectar um protótipo, comparar respostas e experimentar fluxos longos sem calcular o preço de cada milhão de tokens. Mas o preço listado não equivale a uma garantia de disponibilidade, latência, limite de uso ou estabilidade para produção. Esses aspectos não aparecem nos dados disponíveis para os modelos.

A janela de 262.144 tokens também é a mesma nos dois casos. Em termos práticos, esse espaço permite enviar instruções, histórico e documentos extensos em uma única chamada, dentro do limite do modelo. Ainda assim, uma janela maior não garante que o modelo vá recuperar corretamente todas as informações nem que vá raciocinar bem sobre elas.

O contexto é grande, mas não é o maior

O número chama atenção, mas não coloca os modelos no topo absoluto do catálogo. O Google Gemini 2.5 Flash e o Gemini 2.5 Flash Lite aparecem no OpenRouter com janela de 1.048.576 tokens. O Gemini 2.5 Pro também tem esse mesmo limite.

A comparação ajuda a traduzir o anúncio: os Nex-N2.5 oferecem contexto longo, mas não lideram nesse critério. A vantagem mais clara está na combinação entre 262.144 tokens e preço zero, não em um novo recorde de capacidade de contexto.

Há outros modelos recentes próximos nessa faixa. O KAT-Coder-Air V2.5 tem 256.000 tokens de contexto, enquanto o KAT-Coder-Pro V2.5 chega a 262.144. A diferença é que esses modelos têm preços listados de US$ 0,15 e US$ 0,74 por milhão de tokens de entrada, respectivamente; na saída, custam US$ 0,60 e US$ 2,96.

Não há nota para medir qualidade

O Artificial Analysis não apresenta, para o Nex-N2.5-Mini nem para o Nex-N2.5-Pro, uma nota de inteligência, código ou desempenho agêntico nos dados disponíveis. Também não há informação registrada sobre pesos abertos ou número de parâmetros.

Isso impede uma conclusão importante: não dá para afirmar que o Pro é melhor que o Mini em qualidade, programação ou execução de tarefas autônomas apenas pelo nome. “Pro” é uma diferenciação de produto, não uma pontuação de benchmark.

A mesma cautela vale para o uso em produção. Se você opera um chatbot, um agente ou uma rotina de geração de código, o custo zero reduz o risco financeiro do piloto. Não elimina o risco operacional. Antes de substituir um modelo pago, ainda é preciso medir taxa de erro, consistência, tempo de resposta e comportamento nas tarefas específicas da aplicação.

Quem ganha com a estreia

A novidade interessa primeiro a desenvolvedores que precisam testar prompts, pipelines de recuperação de documentos ou fluxos com histórico extenso. Também pode ser útil para equipes pequenas que querem comparar dois modelos sem comprometer orçamento durante a fase de protótipo.

Para quem já escolheu um modelo com desempenho comprovado e precisa de previsibilidade de SLA, a mudança é menor. Os dados não mostram notas de qualidade nem condições comerciais capazes de sustentar uma migração automática.

O lançamento ocorre em um catálogo com 585 modelos de 70 criadores. No mesmo período, houve 20 mudanças de preço e uma estreia no índice de benchmarks, sinal de que a escolha de modelo continua sendo uma decisão de custo e capacidade, não apenas de disponibilidade.

A implicação prática é simples: use Mini e Pro como candidatos gratuitos para testes de contexto longo, mas só leve um deles para uma rota de produção depois de comparar o desempenho com seu tráfego real.

Em uma frase

Os Nex-N2.5 Mini e Pro zeram o custo do teste com 262.144 tokens de contexto, mas ainda não há métricas de qualidade para justificar uma migração em produção.

Perguntas frequentes

Quanto custam o Nex-N2.5 Mini e o Nex-N2.5 Pro na API?

Os dois aparecem no OpenRouter com preço de US$ 0 por milhão de tokens de entrada e de saída. Isso indica custo zero na listagem atual, mas não informa limites de uso, latência ou garantias operacionais.

Qual é a janela de contexto dos modelos Nex-N2.5?

O Nex-N2.5-Mini e o Nex-N2.5-Pro têm janela de 262.144 tokens. O limite é amplo, embora menor que o de 1.048.576 tokens listado para os modelos Gemini 2.5 citados.

O Nex-N2.5-Pro é melhor que o Mini?

Os dados disponíveis não trazem notas de inteligência, código ou desempenho agêntico para nenhum dos dois. Portanto, o nome Pro não basta para comprovar superioridade em qualidade ou adequação à produção.

Leia também