FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Seis lançamentos em sete dias, todos abaixo de US$ 5 por milhão de saída

A semana foi dominada por modelos pequenos e baratos da China e dos EUA, sem corte de preço nem mudança de tabela — o movimento está no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 0,15por milhão de tokens de saída do Qwen3.5-9B
US$ 0,30por milhão de tokens de saída do MiMo-V2-Flash, da Xiaomi
6 lançamentosentre 09 e 15 de março de 2026, todos abaixo de US$ 5/M

A semana que não teve corte de preço

Sete dias, seis modelos novos, zero alteração de tabela. Em um mercado em que corte de preço virou manchete, a notícia de 9 a 15 de março de 2026 é justamente a ausência dela. O que apareceu no catálogo foi outra coisa: uma sequência de lançamentos concentrados na faixa barata da prateleira, vindos em sua maioria da China. Se você paga a API, o efeito prático está numa pergunta simples: dá pra trocar tarefa do modelo topo por um modelo de US$ 0,15 sem perder o sono?

Lançamentos entre 2026-03-09 e 2026-03-15
DataModeloCriadorInteligênciaSaída US$/M
2026-03-10Qwen3.5-9Bqwen0.15
2026-03-10Qwen3.5-9B (batch)qwen0.25
2026-03-10Seed-2.0-Litebytedance-seed2
2026-03-11Nemotron 3 Supernvidia0.4
2026-03-11Nemotron 3 Super (free)nvidia0
2026-03-15GLM 5 Turboz-ai4

O padrão que se repete

Olha o intervalo de preço de saída dos seis lançamentos: Qwen3.5-9B a US$ 0,15, sua versão batch a US$ 0,25, Seed-2.0-Lite da ByteDance a US$ 2, Nemotron 3 Super da NVIDIA a US$ 0,40 (com variante grátis), e GLM 5 Turbo da Z.ai a US$ 4. Todos abaixo de US$ 5 por milhão de tokens de saída. Todos sem nota de IQ publicada ainda — o catálogo só marca IQ para quem já foi medido, e esses acabaram de chegar.

A tradução prática: você não está olhando para substitutos do Gemini 3.1 Pro Preview nem do GPT-5.3-Codex. Está olhando para a faixa em que o trabalho de alto volume — classificação, extração, resumo, roteamento — costuma rodar. É onde a conta dói.

Lançamentos da semana por criador
qwen2nvidia2bytedance-seed1z-ai1modelos

De onde vem cada um

A semana teve assinatura clara. Qwen soltou duas variantes do mesmo 9B no dia 10, uma com preço de tabela e outra batch. ByteDance Seed apareceu no mesmo dia com o 2.0-Lite, mais caro (US$ 2) mas ainda na faixa baixa. NVIDIA entrou em 11 de março com Nemotron 3 Super a US$ 0,40 e uma versão grátis — detalhe relevante para quem testa antes de colocar em produção. Z.ai fechou a semana em 15 com o GLM 5 Turbo a US$ 4, o mais caro do lote, mas ainda muito abaixo dos US$ 12 do Gemini 3.1 Pro Preview e dos US$ 14 do GPT-5.3-Codex.

Cinco criadores diferentes, três deles chineses (Qwen, ByteDance Seed, Z.ai), um americano (NVIDIA) e a Xiaomi, que já está no catálogo com o MiMo-V2-Flash a US$ 0,30 — vale lembrar porque ele continua sendo, junto com o Qwen3.5-9B, o modelo mais barato com nota de IQ medida no catálogo.

O que não mudou

Nenhuma queda de preço foi registrada na semana. Nenhum corte, nenhum aumento. A tabela está congelada desde o fechamento anterior. Isso importa porque parte do noticiário de IA vive de "X ficou 40% mais barato" — não foi o caso desta semana. O movimento aconteceu no catálogo, não na tabela.

Também não houve mudança no topo do ranking de inteligência. Gemini 3.1 Pro Preview segue na frente com IQ 47,738 e US$ 12 por milhão de saída. GPT-5.3-Codex vem logo atrás, IQ 45,512 e US$ 14. A diferença entre os dois e o resto continua grande: Claude Sonnet 4.6 está em IQ 35,108, e os dois modelos chineses medidos (Qwen3.5 397B A17B e MiMo-V2-Flash) ficam na casa de 34. A fronteira de IQ acima de 45 tem só dois modelos, e ambos custam mais de dez vezes o que o Qwen3.5-9B cobra por milhão de saída.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 363 modelos disponíveis no catálogo nesta data.

Para quem isso muda alguma coisa

Se você roda volume — pipelines de classificação, geração curta, pré-processamento — a semana trouxe opções reais. O Qwen3.5-9B a US$ 0,15 e o Nemotron 3 Super com versão grátis são candidatos óbvios para tarefas em que o modelo topo é overkill. Já o GLM 5 Turbo a US$ 4 e o Seed-2.0-Lite a US$ 2 ocupam o meio do caminho: mais capazes que os minis, ainda muito mais baratos que o topo.

Se você precisa do melhor raciocínio disponível, nada mudou. Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem sendo os dois únicos acima de IQ 45, e nenhum lançamento da semana ameaça esse posto. A pergunta que vale fazer antes de migrar carga é a mesma de sempre: qual é o piso de IQ que sua tarefa aceita? Porque nesta semana o piso de preço caiu sem que ninguém mexesse na tabela — só adicionou produto novo.

Em uma frase

Antes de colocar a próxima tarefa no modelo topo, olhe o Qwen3.5-9B a US$ 0,15 e o Nemotron 3 Super grátis para volume; o topo de IQ não mudou e continua custando mais de dez vezes mais.

Perguntas frequentes

Qual foi o modelo de IA mais barato lançado na semana de 9 a 15 de março de 2026?

O Qwen3.5-9B, da Qwen, a US$ 0,15 por milhão de tokens de saída, lançado em 10 de março. A NVIDIA também publicou uma versão grátis do Nemotron 3 Super no dia 11.

Houve corte de preço de modelos de IA em março de 2026?

Não. Entre 9 e 15 de março o catálogo não registrou corte nem aumento de preço. O movimento da semana foi de lançamentos novos, todos concentrados na faixa abaixo de US$ 5 por milhão de tokens de saída.

Os modelos chineses estão mais baratos que os americanos?

Nesta semana, sim. Qwen3.5-9B (US$ 0,15), ByteDance Seed-2.0-Lite (US$ 2) e Z.ai GLM 5 Turbo (US$ 4) saíram mais baratos que o Gemini 3.1 Pro Preview (US$ 12) e o GPT-5.3-Codex (US$ 14), que seguem no topo de IQ.

Leia também