Nemotron Omni é grátis e multimodal — e o índice 15 mostra por quê
Modelo aberto da NVIDIA aceita texto, imagem, áudio e vídeo na mesma chamada. O índice de inteligência 15,007 define em que papel ele entra e em que papel ele não entra.
A NVIDIA colocou no catálogo, há cinco dias, um modelo gratuito que aceita texto, imagem, áudio e vídeo na mesma chamada. Soa como presente. Quando você olha o índice de inteligência, entende por que a descrição da própria NVIDIA o rotula como sub-agente.
O Nemotron 3 Nano Omni está em 15,007 pontos no índice Artificial Analysis. O topo do mercado, nesta data, está em 47,738 com o Gemini 3.1 Pro Preview. Não é diferença de geração, é diferença de função.
O que "grátis" quer dizer aqui
O modelo tem 30 bilhões de parâmetros totais, com 3 bilhões ativos por passada (arquitetura MoE), contexto de 256 mil tokens, pesos abertos e raciocínio ligado. Entrada e saída custam US$ 0 por milhão de tokens. Dos pelo menos 435 modelos no catálogo hoje, são raros os gratuitos que aceitam multimodal de verdade — e os que aceitam costumam cobrar caro por isso.
A NVIDIA usa uma palavra específica na ficha: o Omni foi desenhado como perception and context sub-agent in enterprise agent systems. Traduzindo: ele é o sensor do sistema, não o cérebro.
Pense nele como a câmera de um sistema de segurança. Detecta movimento, identifica rosto, passa o alerta. Quem decide o que fazer com o alerta é outro modelo, com índice três vezes maior.
O par que incomoda
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Nemotron 3 Nano Omni (free) (o novo) | 15.0 | 0 | 0 | 256k |
| gpt-oss-20b | 15.2 | 0.03 | 0.13 | 131k |
| Ministral 3 14B 2512 | 11.2 | 0.2 | 0.2 | 262k |
| Nemotron 3 Nano 30B A3B | 14.5 | 0.05 | 0.2 | 262k |
| Llama 4 Scout | 10.3 | 0.1 | 0.3 | 1.31M |
O rival mais direto é o gpt-oss-20b da OpenAI. Custa US$ 0,03 por milhão de entrada e US$ 0,13 por milhão de saída. Tem IQ 15,225 — praticamente o mesmo do Nemotron. Mas em coding, o gpt-oss marca 20,697 contra 13,754 do Omni. Se a tarefa for gerar código, sai mais barato pagar centavos para a OpenAI.
O próprio Nemotron Nano 30B A3B da NVIDIA, versão paga, sai por US$ 0,20/M de saída, com IQ 14,538 e velocidade 247. O Omni free entrega IQ ligeiramente mais alto, velocidade 326 e multimodal — sem cobrar nada. A diferença de preço é o que decide o uso.
Quando vale a pena usar
Três cenários em que o Nemotron Omni free resolve sem te custar nada:
- Sub-agente de percepção em pipeline multimodal. Você já tem um cérebro (Gemini, DeepSeek V4 Pro, GPT-5.3-Codex) e quer classificar imagem, áudio ou vídeo antes de passar a tarefa adiante.
- Prototipagem local. Pesos abertos, 30B com 3B ativos por passada — cabe em hardware de pesquisador.
- Volume alto de chamadas multimodais com orçamento zero. Quando a fatura da API multimodal é o problema e a qualidade do raciocínio não é o gargalo.
Quando NÃO vale a pena
Aqui é onde a maioria vai tropeçar. Índice 15 não é "bom para um modelo pequeno" — é o fundo da tabela.
Se você precisa de raciocínio forte, qualquer coisa acima de IQ 40 (Gemini 3.1 Pro, GPT-5.3-Codex, DeepSeek V4 Pro) está em outro planeta. O DeepSeek V4 Pro a US$ 1,74 por milhão de saída entrega 45,268 — três vezes mais, por um preço que continua modesto.
Para gerar código, o gpt-oss-20b a US$ 0,13/M já entrega 50% mais nota de coding.
Para tarefas só de texto, o Ministral 3 14B a US$ 0,20/M ou o próprio Nemotron Nano pago a US$ 0,20/M já competem em modalidade e preço.
Onde o catálogo está
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
O catálogo tem pelo menos 435 modelos listados, vindos de 60 criadores. Nos últimos 30 dias, 47 entraram. O segmento "free multimodal pequeno" não está lotado — por isso o Omni ocupa um nicho, não disputa o topo.
O que fazer com isso
Se você roda agente multimodal em produção e paga caro por chamadas de visão e áudio, teste o Nemotron Omni como classificador de percepção. Você pode tirar chamadas caras do seu provedor principal sem perder o cérebro grande.
Se você quer um modelo "bom e barato" para responder pergunta, escrever código ou resumir texto, ignore. Preço zero aqui é isca para um papel específico, não para o papel principal.
Use o Nemotron Omni free como sub-agente multimodal de percepção em pipelines que já têm um cérebro maior; para qualquer tarefa que exija raciocínio real, o índice 15 não compete com nada acima de IQ 40.
Perguntas frequentes
O Nemotron 3 Nano Omni é mesmo gratuito?
Sim, nos dados do catálogo a entrada e a saída custam US$ 0 por milhão de tokens. É uma das poucas ofertas gratuitas que aceita texto, imagem, áudio e vídeo na mesma chamada.
Posso trocar meu modelo principal por ele?
Não. Com índice de inteligência 15,007 ele está no fundo do mercado, enquanto o topo passa de 47. A própria NVIDIA o posiciona como sub-agente de percepção, não como cérebro de raciocínio.
Vale mais a pena que o gpt-oss-20b?
Depende do uso. Em multimodal e em custo zero, o Nemotron Omni ganha. Em coding (20,7 contra 13,8) e em qualquer tarefa só de texto, o gpt-oss-20b da OpenAI entrega mais por centavos.