FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Nex-N2-Pro cai 60% no output enquanto Kimi K2.7 Code sobe 11%

O corte no modelo da Nex AGI e o aumento no da MoonshotAI mexem no meio do tabuleiro — onde a briga por workloads de produção realmente acontece.

Redação FalaVIP IA 3 min de leitura
US$ 1,00novo preço de saída do Nex-N2-Pro por milhão de tokens (era US$ 2,50)
+11%alta do output da Kimi K2.7 Code
+47%alta do input da Rocinante 12B

Oito em cada dez mudanças foram sutis. Uma foi um tombo

Os catálogos mexem em preço quase toda semana — é a parte chata do trabalho de quem escolhe modelo. Mas a janela do dia 23 de junho de 2026 entrou com cinco alterações, e uma delas é grande o suficiente para reposicionar escolha. A Nex AGI cortou o output do Nex-N2-Pro pela metade mais um pouco: saiu de US$ 2,50 para US$ 1,00 por milhão de tokens. No input, a queda foi de US$ 0,50 para US$ 0,25. Traduzindo: se você roda um workload de geração — resumo, texto longo, código com bastante coisa sendo devolvida na resposta — a fatura desse modelo específico cai 60% só na parcela de saída.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
Nex-N2-Pro2.51-60%
Rocinante 12B0.430.5+16%
Kimi K2.7 Code3.0693.41+11%
MiniMax M2.710.96-4%
Phi 40.140.140%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

O outro lado: quem ficou mais caro

Duas altas no mesmo dia, e a Kimi K2.7 Code é o que pesa mais no bolso. O output saiu de US$ 3,07 para US$ 3,41 por milhão de tokens — 11% a mais. Para quem usa Kimi em tarefa de código com prompts grandes recebendo respostas longas, é ajuste que aparece no fim do mês. A Rocinante 12B, da TheDrummer, teve aumento menor em valor absoluto mas mais agressivo em percentual: input subiu de US$ 0,17 para US$ 0,25 por milhão, um salto de 47% que encarece bem o uso em tarefas de classificação e ingestão onde a entrada domina a conta.

Variação do preço de saída (%)
Nex-N2-Pro-60Rocinante 12B16Kimi K2.7 Code11MiniMax M2.7-4Phi 40%

E o resto?

Microsoft Phi 4 e MiniMax M2.7 foram ajustes quase cosméticos. O Phi 4 mexeu meio centavo de dólar no input (de US$ 0,065 para US$ 0,07 por milhão) e manteve o output em US$ 0,14. O M2.7 caiu 4% no output, indo de US$ 1,00 para US$ 0,96 por milhão. Nada que mude decisão de compra — quem já usa, segue usando com a mesma lógica.

Em que isso muda a escolha de quem paga

Se você estava olhando o Nex-N2-Pro e segurou por causa do preço, a conta de hoje pede revisão. O output ficou bem mais competitivo e a razão entre output e input caiu de 5x para 4x — ainda puxado para a saída, mas menos salgado. Vale rodar um teste de qualidade antes de migrar qualquer carga, porque preço é o que mudou hoje; capacidade técnica do modelo é a mesma de ontem.

Do lado de quem usa Kimi em produção, 11% não é gatilho de troca imediato, mas é o tipo de reajuste que justifica colocar rota alternativa na fila. No recorte "barato acima de IQ 45" do catálogo de hoje, MiniMax M3 sai a US$ 1,20 por milhão de output e DeepSeek V4 Pro a US$ 1,74 — bem abaixo dos novos US$ 3,41 da Kimi. Ambos ainda são modelos chineses, vale considerar latência e suporte antes de trocar.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Para quem isso não muda quase nada

Se sua stack roda Claude Fable 5 (US$ 50 por milhão de output, topo do índice de inteligência do catálogo de hoje), GPT-5.3-Codex, Gemini 3.1 Pro Preview ou qualquer modelo de fronteira, nenhum desses nomes aparece nas mudanças de 23 de junho. O topo do tabuleiro segue caro e estável. As alterações mexeram no meio — onde a briga por workloads de produção realmente acontece.

O catálogo fechou o dia com mais de 475 modelos listados, vindos de 61 criadores diferentes. Nos últimos 30 dias entraram 28 novidades. Ou seja: o jogo não é escolher "o melhor modelo", é escolher o modelo certo para cada tipo de chamada — e revisar isso toda semana antes que a fatura conte a história por você.

Em uma frase

Preço é atributo volátil: em 24 horas o Nex-N2-Pro caiu 60% no output enquanto a Kimi K2.7 Code subiu 11%. Antes de fechar workload de produção em qualquer modelo, confira a tabela do dia — a economia (ou o prejuízo) mora nos centavos por milhão de tokens que você não olhou.

Perguntas frequentes

Qual modelo teve o maior corte de preço em 23 de junho de 2026?

Nex-N2-Pro, da Nex AGI. O preço de saída caiu 60%, indo de US$ 2,50 para US$ 1,00 por milhão de tokens; o input também caiu pela metade, de US$ 0,50 para US$ 0,25.

A Kimi K2.7 Code ficou mais cara por quê?

O ajuste aparece na tabela de hoje sem justificativa pública: o output subiu de US$ 3,07 para US$ 3,41 por milhão (+11%) e o input de US$ 0,612 para US$ 0,68. Para quem roda Kimi em geração de código com respostas longas, a diferença aparece na fatura mensal.

Vale migrar para o Nex-N2-Pro depois desse corte?

Para geração com muito output a economia é real (60% na parcela de saída), mas capacidade técnica não muda junto com o preço. Rode um teste de qualidade na sua carga antes de trocar — e lembre que o catálogo mexe quase toda semana, então a vantagem de hoje pode evaporar no próximo reajuste.

Leia também