FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Nemotron 3 Super cobra trinta vezes menos, mas sem índice de inteligência

Modelo aberto de 120B da NVIDIA sai por US$ 0,40 por milhão de tokens de saída; o catálogo ainda não publicou benchmark, então não dá para comparar diretamente com Gemini 3.1 Pro Preview nem GPT-5.3-Codex.

Redação FalaVIP IA 3 min de leitura
US$ 0,40por milhão de tokens de saída
30×mais barato que Gemini 3.1 Pro Preview
1 milhãotokens de contexto na versão paga

O número que ninguém viu passar

US$ 0,40 por milhão de tokens de saída. É o que a NVIDIA está cobrando pelo Nemotron 3 Super a partir de hoje, 11 de março. Compare com o que os modelos acima de IQ 45 custam no catálogo: Gemini 3.1 Pro Preview a US$ 12, GPT-5.3-Codex a US$ 14. A conta de saída do Nemotron é trinta vezes mais barata que a do Gemini — e isso muda a planilha de qualquer um que roda agente em escala.

Preço de saída (US$ por milhão de tokens)
Nemotron 3 Super0,4Gemini 3.1 Pro Preview12GPT-5.3-Codex14Claude Sonnet 4.615US$/M
Fonte: OpenRouter

Trinta vezes. Não é erro de digitação, não é desconto de lançamento. É o preço de tabela publicado pela NVIDIA hoje. Se a qualidade do modelo estiver no mesmo patamar dos rivais, o efeito sobre o custo de produtos agentic é imediato. E é exatamente aí que mora a dúvida.

O que é o Nemotron 3 Super (e o que o anúncio não entrega)

O release descreve um modelo aberto de 120 bilhões de parâmetros totais, mas só 12 bilhões ativos por inferência — arquitetura híbrida Mamba-Transformer. Pense num restaurante com 120 chefs no quadro, mas só 12 cozinham em cada pedido: você paga pela estrutura completa, mas só consome uma fração por chamada. Janela de contexto de 1 milhão de tokens, input a US$ 0,085 por milhão.

Ficha técnica — Nemotron 3 Super
CampoValor
Identificadornvidia/nemotron-3-super-120b-a12b
Criadornvidia
Preço de entradaUS$ 0.085 / M tokens
Preço de saídaUS$ 0.400 / M tokens
Janela de contexto1M
Modalidadetext->text

Não é um modelo pequeno fingindo ser grande. É um grande dividido em pedaços, e cada inferência pega emprestada só a fatia necessária. Esse desenho é o que permite cobrar tão barato sem derreter a margem da operação — MoE com baixa fração ativa é o truque clássico para reduzir custo por token.

Aqui mora a parte que o press release esconde. O catálogo ainda não publicou índice de inteligência, nota de coding nem agentic para o Nemotron 3 Super. Você não consegue comparar diretamente com Gemini 3.1 Pro Preview (IQ 47,7), GPT-5.3-Codex (45,5) ou Claude Sonnet 4.6 (35,1) hoje. Vai precisar rodar a sua própria suite — ou esperar a medição oficial.

Preço absurdo só impressiona se a qualidade acompanhar. Sem benchmark, o argumento de venda está pela metade. E sem série histórica, é impossível dizer se esse modelo é melhor ou pior que o Nemotron anterior.

A versão gratuita que vem junto

A NVIDIA também soltou uma versão free do mesmo modelo, com contexto de 262 mil tokens. Mesma arquitetura, custo zero na entrada e na saída. Útil para prototipar e validar se a qualidade serve antes de mover carga paga. Quem precisa da janela de 1 milhão vai ter que pagar — não há versão grátis com o contexto completo.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Nemotron 3 Super (free)00262k

Onde isso entra no tabuleiro

O catálogo de hoje soma 362 modelos de 53 criadores diferentes. Nos últimos 30 dias, 31 foram lançados — quase um por dia útil. O topo de inteligência segue dominado por Google e OpenAI, com Anthropic logo atrás. O Nemotron entra sem nota publicada, então o eixo "qualidade" ainda está em branco para ele no comparativo geral.

Inteligência × preço de saída
Gemini 3.1 Pro PreviewGPT-5.3-CodexClaude Sonnet 4.6US$ por milhão (saída, escala log)índice de inteligência

Para quem vale — e para quem não muda nada

Vale para quem roda chamadas em volume: pipelines de extração, classificação em massa, agentes que disparam dezenas de inferências por tarefa, sistemas onde cada centavo por token entra no fim do mês. O release cita explicitamente multi-agent applications como alvo — é exatamente o cenário onde o Nemotron 3 Super foi desenhado para caber.

Não muda nada para quem precisa do estado da arte em raciocínio ou coding e tem orçamento para pagar. Se você já usa Gemini Pro ou GPT-5.3-Codex e a fatura não dói, não há motivo racional para trocar no escuro. O movimento certo esta semana é rodar a sua suite de eval no Nemotron 3 Super — inclusive na versão free — antes de mover qualquer carga crítica para ele. Porque, sem índice publicado, o único benchmark que vale é o seu.

Em uma frase

Rode sua suite de eval no Nemotron 3 Super ainda esta semana: o preço é absurdo, mas sem índice publicado o único benchmark válido é o seu.

Perguntas frequentes

O que é o NVIDIA Nemotron 3 Super?

É um modelo aberto de 120 bilhões de parâmetros com arquitetura híbrida Mamba-Transformer e MoE, mas só 12 bilhões de parâmetros ativos por inferência. Janela de contexto de 1 milhão de tokens na versão paga.

Quanto custa o Nemotron 3 Super?

US$ 0,085 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. Existe também uma versão gratuita com contexto de 262 mil tokens e custo zero nas duas pontas.

O Nemotron 3 Super substitui Gemini 3.1 Pro ou GPT-5.3-Codex?

Ainda não dá para afirmar. O catálogo não publicou índice de inteligência, coding nem agentic para esse modelo. Antes de mover carga crítica, rode sua própria suite de avaliação na versão free e na paga.

Leia também