Nemotron 3 Super cobra trinta vezes menos, mas sem índice de inteligência
Modelo aberto de 120B da NVIDIA sai por US$ 0,40 por milhão de tokens de saída; o catálogo ainda não publicou benchmark, então não dá para comparar diretamente com Gemini 3.1 Pro Preview nem GPT-5.3-Codex.
O número que ninguém viu passar
US$ 0,40 por milhão de tokens de saída. É o que a NVIDIA está cobrando pelo Nemotron 3 Super a partir de hoje, 11 de março. Compare com o que os modelos acima de IQ 45 custam no catálogo: Gemini 3.1 Pro Preview a US$ 12, GPT-5.3-Codex a US$ 14. A conta de saída do Nemotron é trinta vezes mais barata que a do Gemini — e isso muda a planilha de qualquer um que roda agente em escala.
Trinta vezes. Não é erro de digitação, não é desconto de lançamento. É o preço de tabela publicado pela NVIDIA hoje. Se a qualidade do modelo estiver no mesmo patamar dos rivais, o efeito sobre o custo de produtos agentic é imediato. E é exatamente aí que mora a dúvida.
O que é o Nemotron 3 Super (e o que o anúncio não entrega)
O release descreve um modelo aberto de 120 bilhões de parâmetros totais, mas só 12 bilhões ativos por inferência — arquitetura híbrida Mamba-Transformer. Pense num restaurante com 120 chefs no quadro, mas só 12 cozinham em cada pedido: você paga pela estrutura completa, mas só consome uma fração por chamada. Janela de contexto de 1 milhão de tokens, input a US$ 0,085 por milhão.
| Campo | Valor |
|---|---|
| Identificador | nvidia/nemotron-3-super-120b-a12b |
| Criador | nvidia |
| Preço de entrada | US$ 0.085 / M tokens |
| Preço de saída | US$ 0.400 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text->text |
Não é um modelo pequeno fingindo ser grande. É um grande dividido em pedaços, e cada inferência pega emprestada só a fatia necessária. Esse desenho é o que permite cobrar tão barato sem derreter a margem da operação — MoE com baixa fração ativa é o truque clássico para reduzir custo por token.
Aqui mora a parte que o press release esconde. O catálogo ainda não publicou índice de inteligência, nota de coding nem agentic para o Nemotron 3 Super. Você não consegue comparar diretamente com Gemini 3.1 Pro Preview (IQ 47,7), GPT-5.3-Codex (45,5) ou Claude Sonnet 4.6 (35,1) hoje. Vai precisar rodar a sua própria suite — ou esperar a medição oficial.
Preço absurdo só impressiona se a qualidade acompanhar. Sem benchmark, o argumento de venda está pela metade. E sem série histórica, é impossível dizer se esse modelo é melhor ou pior que o Nemotron anterior.
A versão gratuita que vem junto
A NVIDIA também soltou uma versão free do mesmo modelo, com contexto de 262 mil tokens. Mesma arquitetura, custo zero na entrada e na saída. Útil para prototipar e validar se a qualidade serve antes de mover carga paga. Quem precisa da janela de 1 milhão vai ter que pagar — não há versão grátis com o contexto completo.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Nemotron 3 Super (free) | 0 | 0 | 262k |
Onde isso entra no tabuleiro
O catálogo de hoje soma 362 modelos de 53 criadores diferentes. Nos últimos 30 dias, 31 foram lançados — quase um por dia útil. O topo de inteligência segue dominado por Google e OpenAI, com Anthropic logo atrás. O Nemotron entra sem nota publicada, então o eixo "qualidade" ainda está em branco para ele no comparativo geral.
Para quem vale — e para quem não muda nada
Vale para quem roda chamadas em volume: pipelines de extração, classificação em massa, agentes que disparam dezenas de inferências por tarefa, sistemas onde cada centavo por token entra no fim do mês. O release cita explicitamente multi-agent applications como alvo — é exatamente o cenário onde o Nemotron 3 Super foi desenhado para caber.
Não muda nada para quem precisa do estado da arte em raciocínio ou coding e tem orçamento para pagar. Se você já usa Gemini Pro ou GPT-5.3-Codex e a fatura não dói, não há motivo racional para trocar no escuro. O movimento certo esta semana é rodar a sua suite de eval no Nemotron 3 Super — inclusive na versão free — antes de mover qualquer carga crítica para ele. Porque, sem índice publicado, o único benchmark que vale é o seu.
Rode sua suite de eval no Nemotron 3 Super ainda esta semana: o preço é absurdo, mas sem índice publicado o único benchmark válido é o seu.
Perguntas frequentes
O que é o NVIDIA Nemotron 3 Super?
É um modelo aberto de 120 bilhões de parâmetros com arquitetura híbrida Mamba-Transformer e MoE, mas só 12 bilhões de parâmetros ativos por inferência. Janela de contexto de 1 milhão de tokens na versão paga.
Quanto custa o Nemotron 3 Super?
US$ 0,085 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. Existe também uma versão gratuita com contexto de 262 mil tokens e custo zero nas duas pontas.
O Nemotron 3 Super substitui Gemini 3.1 Pro ou GPT-5.3-Codex?
Ainda não dá para afirmar. O catálogo não publicou índice de inteligência, coding nem agentic para esse modelo. Antes de mover carga crítica, rode sua própria suite de avaliação na versão free e na paga.