FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Três lançamentos em sete dias e nenhum corte de preço

IBM, Qwen e MiniMax estreiam modelos entre 20 e 26 de outubro; o catálogo não mexeu em preço e o topo da tabela continua o mesmo.

Redação FalaVIP IA 3 min de leitura
3modelos lançados entre 20 e 26 de outubro de 2025
0mudanças de preço no catálogo na semana
263modelos listados no catálogo em 26 de outubro

A semana que não mexeu no boleto

Se você abriu o painel da API esperando corte de preço, pode fechar a aba: entre 20 e 26 de outubro de 2025 o catálogo não promoveu um único ajuste de tarifa. Zero cortes, zero aumentos. Em uma rotina em que toda terça tem novidade, uma semana sem mexer no preço já é, por si só, uma notícia.

Lançamentos da semana por criador
ibm-granite1qwen1minimax1modelos

O movimento aconteceu todo do lado da prateleira: três modelos novos pousaram no catálogo em sete dias. É pouco se você comparar com semanas de vinte lançamentos, mas é o suficiente para mudar a conversa — porque os três vieram de três criadores diferentes e cada um ocupa um canto distinto do espectro.

IBM abre a semana com o modelo mais barato do lote

No dia 20 de outubro, a IBM colocou no ar o Granite 4.0 Micro. O índice de inteligência registrado é 1,952 e o preço de saída é de US$ 0,112 por milhão de tokens. É um modelo pequeno, com IQ modesto se comparado ao topo da tabela, e o posicionamento deixa claro o público: tarefas internas, classificação, extração, sumarização barata. Para quem roda um pipeline de NLP em volume e precisa de algo que não estoure a fatura, ele entra na lista de opções. Para quem está atrás de raciocínio de ponta, não é essa a porta.

Qwen e MiniMax apostam em visão e em preço agressivo

Na quinta-feira, 23 de outubro, dois modelos caíram no mesmo dia. O Qwen3 VL 32B Instruct chegou sem índice de inteligência publicado no catálogo — o que, na prática, significa que a medição ainda não foi feita ou não foi divulgada. O preço de saída é de US$ 0,416 por milhão de tokens. O sufixo "VL" indica que ele entende imagens além de texto; é um multimodal de 32 bilhões de parâmetros da família Qwen3, voltado para quem precisa de visão sem pagar o preço dos modelos grandes.

No mesmo dia, a MiniMax lançou o MiniMax M2, também sem IQ registrado e a US$ 1,02 por milhão de tokens de saída. Aqui o ângulo é diferente: o preço é mais alto que o do Qwen3 VL, mas o modelo é da MiniMax, uma criadora chinesa que tem apostado em modelos de raciocínio com tarifas competitivas. Para quem está montando um stack multi-criador, vale testar.

Lançamentos entre 2025-10-20 e 2025-10-26
DataModeloCriadorInteligênciaSaída US$/M
2025-10-20Granite 4.0 Microibm-granite2.00.112
2025-10-23Qwen3 VL 32B Instructqwen0.416
2025-10-23MiniMax M2minimax1.02

O topo da tabela não se mexeu

Enquanto os lançamentos aconteciam na faixa intermediária e de baixo custo, o topo do ranking continua exatamente onde estava. OpenAI o3 lidera com IQ 31,096 a US$ 8 por milhão de tokens de saída; Claude Haiku 4.5, da Anthropic, aparece em segundo com 29,892 e US$ 5; gpt-oss-120b, da própria OpenAI, segura a terceira posição com 24,126 e US$ 0,17 — o melhor custo-benefício entre os modelos fortes do catálogo. O Qwen3 Next 80B A3B Thinking fecha o top 5 com 16,867 e US$ 1,20.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 263 modelos disponíveis no catálogo nesta data.

Nenhum dos três lançamentos da semana aparece nessa lista. Isso responde, sem rodeio, à pergunta que aparece todo fechamento de semana: vale trocar o que está rodando? Não, pelo menos não para quem usa o topo.

Para quem essa semana muda alguma coisa

Se você roda tarefas simples em volume — classificação, extração, sumarização —, o Granite 4.0 Micro entra como opção barata de prateleira. Se o seu produto precisa de visão computacional sem estourar o custo, o Qwen3 VL 32B Instruct é a novidade a testar. Se você quer diversificar criadores no stack e já está confortável com a MiniMax, o M2 é mais um motivo para olhar para eles.

Se você está pagando o3 ou Claude Haiku 4.5 para fazer o que esses modelos pequenos já fariam, essa semana é um lembrete: dá para economizar sem perder o sono. Mas se a sua carga depende do topo da tabela, o resumo é simples — nada mudou para você.

O que ficou de fora

O catálogo tem hoje 263 modelos listados, vindos de 41 criadores, e 24 lançamentos nos últimos 30 dias. O número de 263 é um piso: modelos removidos depois do lançamento não aparecem mais. Em sete dias, três chegaram e nenhum saiu. Em outras palavras, o catálogo continua inchando devagar, sem correção de rota nos preços. Para quem planeja orçamento de API, a mensagem é direta: a próxima semana pode trazer corte, pode trazer aumento — esta, definitivamente, não trouxe.

Em uma frase

Sem mudança de preço na semana, o caminho para economizar é trocar tarefas leves por modelos novos e baratos como o Granite 4.0 Micro; quem depende do topo da tabela não precisa mexer em nada.

Perguntas frequentes

Quais modelos de IA foram lançados na semana de 20 a 26 de outubro de 2025?

Três: IBM Granite 4.0 Micro (20/10), Qwen3 VL 32B Instruct (23/10) e MiniMax M2 (23/10). Os dois últimos são da família multimodal e de raciocínio, respectivamente, e ambos chegaram sem índice de inteligência publicado no catálogo.

Houve corte de preço de API de IA na semana?

Não. O catálogo não registrou nenhuma mudança de preço entre 20 e 26 de outubro de 2025: zero cortes e zero aumentos. A semana foi de lançamentos, não de reajuste.

Qual é o modelo mais inteligente do catálogo em outubro de 2025?

O OpenAI o3 lidera com IQ 31,096, seguido por Claude Haiku 4.5 (29,892) e gpt-oss-120b (24,126). Os três lançamentos da semana não aparecem no topo da tabela.

Leia também