FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nemotron Omni é grátis e multimodal — e o índice 15 mostra por quê

Modelo aberto da NVIDIA aceita texto, imagem, áudio e vídeo na mesma chamada. O índice de inteligência 15,007 define em que papel ele entra e em que papel ele não entra.

Redação FalaVIP IA 3 min de leitura
15,007índice de inteligência do Nemotron Omni free
US$ 0por milhão de tokens de entrada e de saída
47,738índice do líder de mercado, o Gemini 3.1 Pro Preview

A NVIDIA colocou no catálogo, há cinco dias, um modelo gratuito que aceita texto, imagem, áudio e vídeo na mesma chamada. Soa como presente. Quando você olha o índice de inteligência, entende por que a descrição da própria NVIDIA o rotula como sub-agente.

O Nemotron 3 Nano Omni está em 15,007 pontos no índice Artificial Analysis. O topo do mercado, nesta data, está em 47,738 com o Gemini 3.1 Pro Preview. Não é diferença de geração, é diferença de função.

Índice de inteligência (Artificial Analysis)
Nemotron 3 Nano Omni (free)15gpt-oss-20b15,2Ministral 3 14B 251211,2Nemotron 3 Nano 30B A3B14,5Llama 4 Scout10,3índice
Fonte: Artificial Analysis

O que "grátis" quer dizer aqui

O modelo tem 30 bilhões de parâmetros totais, com 3 bilhões ativos por passada (arquitetura MoE), contexto de 256 mil tokens, pesos abertos e raciocínio ligado. Entrada e saída custam US$ 0 por milhão de tokens. Dos pelo menos 435 modelos no catálogo hoje, são raros os gratuitos que aceitam multimodal de verdade — e os que aceitam costumam cobrar caro por isso.

A NVIDIA usa uma palavra específica na ficha: o Omni foi desenhado como perception and context sub-agent in enterprise agent systems. Traduzindo: ele é o sensor do sistema, não o cérebro.

Pense nele como a câmera de um sistema de segurança. Detecta movimento, identifica rosto, passa o alerta. Quem decide o que fazer com o alerta é outro modelo, com índice três vezes maior.

O par que incomoda

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Nemotron 3 Nano Omni (free) (o novo)15.000256k
gpt-oss-20b15.20.030.13131k
Ministral 3 14B 251211.20.20.2262k
Nemotron 3 Nano 30B A3B14.50.050.2262k
Llama 4 Scout10.30.10.31.31M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O rival mais direto é o gpt-oss-20b da OpenAI. Custa US$ 0,03 por milhão de entrada e US$ 0,13 por milhão de saída. Tem IQ 15,225 — praticamente o mesmo do Nemotron. Mas em coding, o gpt-oss marca 20,697 contra 13,754 do Omni. Se a tarefa for gerar código, sai mais barato pagar centavos para a OpenAI.

O próprio Nemotron Nano 30B A3B da NVIDIA, versão paga, sai por US$ 0,20/M de saída, com IQ 14,538 e velocidade 247. O Omni free entrega IQ ligeiramente mais alto, velocidade 326 e multimodal — sem cobrar nada. A diferença de preço é o que decide o uso.

Preço de saída (US$ por milhão de tokens)
gpt-oss-20b0,13Ministral 3 14B 25120,2Nemotron 3 Nano 30B A3B0,2Llama 4 Scout0,3US$/M
Fonte: OpenRouter

Quando vale a pena usar

Três cenários em que o Nemotron Omni free resolve sem te custar nada:

  1. Sub-agente de percepção em pipeline multimodal. Você já tem um cérebro (Gemini, DeepSeek V4 Pro, GPT-5.3-Codex) e quer classificar imagem, áudio ou vídeo antes de passar a tarefa adiante.
  2. Prototipagem local. Pesos abertos, 30B com 3B ativos por passada — cabe em hardware de pesquisador.
  3. Volume alto de chamadas multimodais com orçamento zero. Quando a fatura da API multimodal é o problema e a qualidade do raciocínio não é o gargalo.

Quando NÃO vale a pena

Aqui é onde a maioria vai tropeçar. Índice 15 não é "bom para um modelo pequeno" — é o fundo da tabela.

Inteligência × preço de saída
gpt-oss-20bMinistral 3 14B 2512Nemotron 3 Nano 30B A3BLlama 4 ScoutUS$ por milhão (saída, escala log)índice de inteligência

Se você precisa de raciocínio forte, qualquer coisa acima de IQ 40 (Gemini 3.1 Pro, GPT-5.3-Codex, DeepSeek V4 Pro) está em outro planeta. O DeepSeek V4 Pro a US$ 1,74 por milhão de saída entrega 45,268 — três vezes mais, por um preço que continua modesto.

Para gerar código, o gpt-oss-20b a US$ 0,13/M já entrega 50% mais nota de coding.

Para tarefas só de texto, o Ministral 3 14B a US$ 0,20/M ou o próprio Nemotron Nano pago a US$ 0,20/M já competem em modalidade e preço.

Onde o catálogo está

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 435 modelos disponíveis no catálogo nesta data.

O catálogo tem pelo menos 435 modelos listados, vindos de 60 criadores. Nos últimos 30 dias, 47 entraram. O segmento "free multimodal pequeno" não está lotado — por isso o Omni ocupa um nicho, não disputa o topo.

O que fazer com isso

Se você roda agente multimodal em produção e paga caro por chamadas de visão e áudio, teste o Nemotron Omni como classificador de percepção. Você pode tirar chamadas caras do seu provedor principal sem perder o cérebro grande.

Se você quer um modelo "bom e barato" para responder pergunta, escrever código ou resumir texto, ignore. Preço zero aqui é isca para um papel específico, não para o papel principal.

Em uma frase

Use o Nemotron Omni free como sub-agente multimodal de percepção em pipelines que já têm um cérebro maior; para qualquer tarefa que exija raciocínio real, o índice 15 não compete com nada acima de IQ 40.

Perguntas frequentes

O Nemotron 3 Nano Omni é mesmo gratuito?

Sim, nos dados do catálogo a entrada e a saída custam US$ 0 por milhão de tokens. É uma das poucas ofertas gratuitas que aceita texto, imagem, áudio e vídeo na mesma chamada.

Posso trocar meu modelo principal por ele?

Não. Com índice de inteligência 15,007 ele está no fundo do mercado, enquanto o topo passa de 47. A própria NVIDIA o posiciona como sub-agente de percepção, não como cérebro de raciocínio.

Vale mais a pena que o gpt-oss-20b?

Depende do uso. Em multimodal e em custo zero, o Nemotron Omni ganha. Em coding (20,7 contra 13,8) e em qualquer tarefa só de texto, o gpt-oss-20b da OpenAI entrega mais por centavos.

Leia também