FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Semana fechou com 4 lançamentos e nenhum corte de preço

Qwen, Z.ai e MiniMax colocaram modelos novos. Quem já estava no catálogo não mexeu na etiqueta.

Redação FalaVIP IA 3 min de leitura
4lançamentos entre 09 e 15 de fevereiro de 2026
US$ 1,92por milhão de tokens de saída do GLM 5
US$ 0,30por milhão de tokens de saída do Xiaomi MiMo-V2-Flash, atual topo de IQ

Quatro modelos novos em sete dias. Zero mudanças de preço no resto do catálogo. A semana que terminou em 15 de fevereiro de 2026 foi de prateleira maior, não de guerra de tabela — e isso diz mais sobre o momento do que qualquer lançamento isolado.

O cardápio cresceu, a conta dos antigos não mudou

Lançamentos entre 2026-02-09 e 2026-02-15
DataModeloCriadorInteligênciaSaída US$/M
2026-02-09Qwen3 Max Thinkingqwen3.9
2026-02-11GLM 5z-ai1.92
2026-02-12MiniMax M2.5 (free)minimax0
2026-02-12MiniMax M2.5minimax1.08

O cardápio do mês tem hoje mais de 334 modelos, com 19 novidades nos últimos 30 dias e 4 delas chegando só nesta janela. Mesmo assim, nenhum modelo já listado mudou de preço. Não houve corte, não houve aumento. Para um desenvolvedor que paga fatura de API, isso vale ouro: significa que dá para planejar a próxima sprint olhando só para os lançamentos novos, sem se preocupar com o que já estava rodando em produção.

A pergunta que fica é se a calmaria de preços é coincidência ou estratégia. Com 4 modelos entrando em uma semana, a oferta claramente está crescendo. Mas os incumbentes não responderam na tabela — sinal de que ninguém quer abrir margem agora, mesmo com tanta alternativa nova rondando.

Três laboratórios chineses, um mesmo roteiro

Lançamentos da semana por criador
minimax2qwen1z-ai1modelos

Os quatro lançamentos vieram de três criadores, todos com base na China. Qwen abriu a semana em 9 de fevereiro com o Qwen3 Max Thinking, cobrando US$ 3,90 por milhão de tokens de saída. Dois dias depois, a Z.ai entrou com o GLM 5 a US$ 1,92. Na quinta-feira, a MiniMax publicou o M2.5 a US$ 1,08 e, na mesma hora, uma versão gratuita do mesmo modelo cobrada a US$ 0.

Os quatro chegam sem IQ medido ainda no catálogo — o índice desses modelos é null até serem testados. Dá para comprar pelo preço, mas não dá para ranquear com o resto. Para um time que está explorando, a versão gratuita do M2.5 é o único custo zero entre os lançamentos recentes, e vale um fim de semana de teste. Para um produto já em produção, o Qwen3 Max Thinking sendo o mais caro do lote só compensa se a tarefa exigir o que ele promete — e como não tem benchmark publicado, isso vira teste empírico, não escolha informada.

O topo do mercado continua onde estava

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 334 modelos disponíveis no catálogo nesta data.

Enquanto a prateleira da frente se mexia, o ranking dos mais inteligentes não se mexeu. O Xiaomi MiMo-V2-Flash segue na frente com IQ 34,024, cobrando US$ 0,30 por milhão de tokens de saída. Logo atrás vem o OpenAI o3, com IQ 31,096 e US$ 8 por milhão — ou seja, cerca de 26 vezes mais caro que o líder.

Nada disso significa que o Xiaomi subiu ou o o3 caiu: esses são os índices de hoje, não uma série de medições ao longo do tempo. O que dá para afirmar é a fotografia atual. Para um workload onde cada chamada precisa do melhor raciocínio disponível, pagar oito dólares faz sentido. Para uma API que atende volume, o MiMo-V2-Flash a trinta centavos muda a conta de outra forma.

O que muda e o que não muda para você

  • Para quem está avaliando modelo novo: a versão gratuita do M2.5 é o caminho mais barato para experimentar a leva de fevereiro. Em volume, o GLM 5 a US$ 1,92 ocupa um meio-termo razoável.
  • Para quem roda OpenAI, Anthropic ou os Qwen anteriores em produção: não há motivo para trocar agora — nenhuma etiqueta mexeu, nenhum corte de preço derrubou o concorrente.
  • Para quem está decidindo pelo topo de IQ: Xiaomi MiMo-V2-Flash segue como a melhor relação inteligência/preço do catálogo, seguido do OpenAI o3 se a tarefa justificar a conta.

E um detalhe importante sobre o número do catálogo: hoje há mais de 334 modelos listados, mas esse é um piso. Modelos antigos podem ter sido removidos e a contagem não revelar o que existiu. Quando alguém te vender um número exato, desconfie.

Em uma frase

A semana entrou 4 modelos novos e mexeu em zero preços — vale testar os lançamentos gratuitos primeiro, só trocar o que já está em produção se a economia for óbvia.

Perguntas frequentes

Algum modelo mudou de preço na semana?

Não. Entre 9 e 15 de fevereiro de 2026 não houve corte nem aumento em nenhum dos modelos listados no catálogo. Toda a movimentação foi de modelos novos entrando, não dos antigos mexendo na etiqueta.

Qual o lançamento mais barato da semana?

A versão gratuita do MiniMax M2.5, cobrada a US$ 0 por milhão de tokens de saída. Entre os modelos pagos da semana, o próprio M2.5 lidera a US$ 1,08 por milhão, seguido do GLM 5 a US$ 1,92.

Vale trocar o OpenAI o3 pelo Xiaomi MiMo-V2-Flash?

Depende do perfil de uso. O MiMo-V2-Flash tem IQ mais alto no índice atual (34,024 contra 31,096 do o3) e custa US$ 0,30 por milhão de tokens contra US$ 8 — diferença grande na fatura em volume. Para tarefas que dependem dos pontos fortes específicos do o3, vale testar antes de migrar a produção inteira.

Leia também