Seis lançamentos em sete dias, todos abaixo de US$ 5 por milhão de saída
A semana foi dominada por modelos pequenos e baratos da China e dos EUA, sem corte de preço nem mudança de tabela — o movimento está no catálogo.
A semana que não teve corte de preço
Sete dias, seis modelos novos, zero alteração de tabela. Em um mercado em que corte de preço virou manchete, a notícia de 9 a 15 de março de 2026 é justamente a ausência dela. O que apareceu no catálogo foi outra coisa: uma sequência de lançamentos concentrados na faixa barata da prateleira, vindos em sua maioria da China. Se você paga a API, o efeito prático está numa pergunta simples: dá pra trocar tarefa do modelo topo por um modelo de US$ 0,15 sem perder o sono?
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-03-10 | Qwen3.5-9B | qwen | — | 0.15 |
| 2026-03-10 | Qwen3.5-9B (batch) | qwen | — | 0.25 |
| 2026-03-10 | Seed-2.0-Lite | bytedance-seed | — | 2 |
| 2026-03-11 | Nemotron 3 Super | nvidia | — | 0.4 |
| 2026-03-11 | Nemotron 3 Super (free) | nvidia | — | 0 |
| 2026-03-15 | GLM 5 Turbo | z-ai | — | 4 |
O padrão que se repete
Olha o intervalo de preço de saída dos seis lançamentos: Qwen3.5-9B a US$ 0,15, sua versão batch a US$ 0,25, Seed-2.0-Lite da ByteDance a US$ 2, Nemotron 3 Super da NVIDIA a US$ 0,40 (com variante grátis), e GLM 5 Turbo da Z.ai a US$ 4. Todos abaixo de US$ 5 por milhão de tokens de saída. Todos sem nota de IQ publicada ainda — o catálogo só marca IQ para quem já foi medido, e esses acabaram de chegar.
A tradução prática: você não está olhando para substitutos do Gemini 3.1 Pro Preview nem do GPT-5.3-Codex. Está olhando para a faixa em que o trabalho de alto volume — classificação, extração, resumo, roteamento — costuma rodar. É onde a conta dói.
De onde vem cada um
A semana teve assinatura clara. Qwen soltou duas variantes do mesmo 9B no dia 10, uma com preço de tabela e outra batch. ByteDance Seed apareceu no mesmo dia com o 2.0-Lite, mais caro (US$ 2) mas ainda na faixa baixa. NVIDIA entrou em 11 de março com Nemotron 3 Super a US$ 0,40 e uma versão grátis — detalhe relevante para quem testa antes de colocar em produção. Z.ai fechou a semana em 15 com o GLM 5 Turbo a US$ 4, o mais caro do lote, mas ainda muito abaixo dos US$ 12 do Gemini 3.1 Pro Preview e dos US$ 14 do GPT-5.3-Codex.
Cinco criadores diferentes, três deles chineses (Qwen, ByteDance Seed, Z.ai), um americano (NVIDIA) e a Xiaomi, que já está no catálogo com o MiMo-V2-Flash a US$ 0,30 — vale lembrar porque ele continua sendo, junto com o Qwen3.5-9B, o modelo mais barato com nota de IQ medida no catálogo.
O que não mudou
Nenhuma queda de preço foi registrada na semana. Nenhum corte, nenhum aumento. A tabela está congelada desde o fechamento anterior. Isso importa porque parte do noticiário de IA vive de "X ficou 40% mais barato" — não foi o caso desta semana. O movimento aconteceu no catálogo, não na tabela.
Também não houve mudança no topo do ranking de inteligência. Gemini 3.1 Pro Preview segue na frente com IQ 47,738 e US$ 12 por milhão de saída. GPT-5.3-Codex vem logo atrás, IQ 45,512 e US$ 14. A diferença entre os dois e o resto continua grande: Claude Sonnet 4.6 está em IQ 35,108, e os dois modelos chineses medidos (Qwen3.5 397B A17B e MiMo-V2-Flash) ficam na casa de 34. A fronteira de IQ acima de 45 tem só dois modelos, e ambos custam mais de dez vezes o que o Qwen3.5-9B cobra por milhão de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
Para quem isso muda alguma coisa
Se você roda volume — pipelines de classificação, geração curta, pré-processamento — a semana trouxe opções reais. O Qwen3.5-9B a US$ 0,15 e o Nemotron 3 Super com versão grátis são candidatos óbvios para tarefas em que o modelo topo é overkill. Já o GLM 5 Turbo a US$ 4 e o Seed-2.0-Lite a US$ 2 ocupam o meio do caminho: mais capazes que os minis, ainda muito mais baratos que o topo.
Se você precisa do melhor raciocínio disponível, nada mudou. Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem sendo os dois únicos acima de IQ 45, e nenhum lançamento da semana ameaça esse posto. A pergunta que vale fazer antes de migrar carga é a mesma de sempre: qual é o piso de IQ que sua tarefa aceita? Porque nesta semana o piso de preço caiu sem que ninguém mexesse na tabela — só adicionou produto novo.
Antes de colocar a próxima tarefa no modelo topo, olhe o Qwen3.5-9B a US$ 0,15 e o Nemotron 3 Super grátis para volume; o topo de IQ não mudou e continua custando mais de dez vezes mais.
Perguntas frequentes
Qual foi o modelo de IA mais barato lançado na semana de 9 a 15 de março de 2026?
O Qwen3.5-9B, da Qwen, a US$ 0,15 por milhão de tokens de saída, lançado em 10 de março. A NVIDIA também publicou uma versão grátis do Nemotron 3 Super no dia 11.
Houve corte de preço de modelos de IA em março de 2026?
Não. Entre 9 e 15 de março o catálogo não registrou corte nem aumento de preço. O movimento da semana foi de lançamentos novos, todos concentrados na faixa abaixo de US$ 5 por milhão de tokens de saída.
Os modelos chineses estão mais baratos que os americanos?
Nesta semana, sim. Qwen3.5-9B (US$ 0,15), ByteDance Seed-2.0-Lite (US$ 2) e Z.ai GLM 5 Turbo (US$ 4) saíram mais baratos que o Gemini 3.1 Pro Preview (US$ 12) e o GPT-5.3-Codex (US$ 14), que seguem no topo de IQ.