FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Cinco modelos ficaram mais baratos e um ficou mais caro em 24 horas

Repasse de preço do dia derruba saída do MiniMax M2.5 pela metade e mexe em seis modelos — vale trocar de cavalo?

Redação FalaVIP IA 3 min de leitura
US$ 0,48por milhão de tokens de saída do MiniMax M2.5 (era US$ 0,90)
US$ 0,72por milhão de tokens de saída do MiniMax M2.7 (era US$ 0,96)
US$ 0,15por milhão de tokens de saída do gpt-oss-120b (era US$ 0,18)

Seis modelos mexeram no preço entre ontem e hoje. Cinco caíram, um subiu. Parece pouco, mas é o tipo de movimento que muda a conta de quem roda lote de inferência todo mês — e a maioria das mudanças veio de fabricantes chineses e de pesos abertos.

O corte do dia é do MiniMax M2.5

O destaque negativo do repasse — no bom sentido para o seu bolso — é o MiniMax: MiniMax M2.5. O token de saída caiu de US$ 0,90 para US$ 0,48 por milhão. Isso é quase metade do que custava ontem (queda de 47%). O de entrada também cedeu, de US$ 0,15 para US$ 0,12. Para quem usa o modelo em tarefas com muito texto gerado — resumo, classificação, agentes — o efeito na fatura é imediato.

O M2.7, da mesma casa, também entrou na dança: saída de US$ 0,96 para US$ 0,72 (corte de 25%) e entrada de US$ 0,24 para US$ 0,18. É o tipo de ajuste que costuma indicar reposicionamento de catálogo — o M2.7 está sendo empurrado para baixo na pirâmide, abrindo espaço para o irmão mais novo.

Variação do preço de saída (%)
MiniMax M2.5-47MiniMax M2.7-25DeepSeek V4 Flash 0423-20DeepSeek V4 Flash 042324gpt-oss-120b-17Nemotron 3 Super-11%

O único que subiu foi o DeepSeek V4 Flash

Olha que detalhe: o DeepSeek V4 Flash aparece duas vezes na lista de hoje. Primeiro caiu — saída de US$ 0,224 para US$ 0,180 e entrada de US$ 0,089 para US$ 0,090. Depois voltou a subir — saída de US$ 0,180 para US$ 0,224 e entrada de US$ 0,090 para US$ 0,089. É o típico ajuste de ida e volta em que o provedor corrige um repasse anterior. Para o usuário final, a mensagem é: o preço de tabela do Flash hoje é o do segundo movimento, ou seja, mais caro que o da manhã.

Não é um estouro — a alta líquida do Flash é de 24% na saída — mas é a única alta do dia. Tudo o mais caiu.

OpenAI e NVIDIA também cederam

O gpt-oss-120b, da OpenAI, viu a entrada cair de US$ 0,039 para US$ 0,030 por milhão e a saída ir de US$ 0,180 para US$ 0,150. É um corte pequeno em pontos percentuais, mas em um modelo de pesos abertos com 120 bilhões de parâmetros é o tipo de ajuste que faz diferença em cargas com muito prompt.

A NVIDIA entrou no movimento com o Nemotron 3 Super 120B-A12B: entrada de US$ 0,090 para US$ 0,085 e saída de US$ 0,450 para US$ 0,400. Corte modesto, de 11% na saída, mas coerente com a tendência do dia.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
MiniMax M2.50.90.48-47%
MiniMax M2.70.960.72-25%
DeepSeek V4 Flash 04230.2240.18-20%
DeepSeek V4 Flash 04230.180.224+24%
gpt-oss-120b0.180.15-17%
Nemotron 3 Super0.450.4-11%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Para quem isso muda a conta — e para quem não muda nada

Vale repensar se: você roda o MiniMax M2.5 ou M2.7 em produção com volume alto de saída. O corte de 47% no M2.5 é grande o suficiente para rebalancear a escolha entre ele e alternativas mais baratas do catálogo.

Não muda nada se: você consome poucos tokens por mês ou já está em um modelo de fronteira. O topo de inteligência continua o mesmo: Claude Fable 5, da Anthropic, lidera com folga (IQ 62), seguido por Z.ai GLM 5.2 e pelos Google Gemini 3.1 Pro Preview e 3.5 Flash. Nenhum desses mexeu no preço.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 477 modelos disponíveis no catálogo nesta data.

O tabuleiro de preços mais baratos com IQ acima de 45

Quando você olha o recorte de modelos com IQ acima de 45 e menor custo de saída, o MiniMax M3 lidera a US$ 1,20 por milhão de tokens de saída — à frente do DeepSeek V4 Pro (US$ 1,74) e do Z.ai GLM 5.2 (US$ 3,036). Repasses como o de hoje tendem a apertar ainda mais essa faixa, porque os modelos que disputam a base da pirâmide são justamente os que ajustam preço com frequência.

O que fazer agora

Se você tem o M2.5 ou o M2.7 em produção, vale rodar uma comparação curta com a alternativa que já estava no seu shortlist — o corte pode ter invertido a relação custo-benefício. Para o DeepSeek V4 Flash, espere um dia antes de recalcular, porque o preço oscilou duas vezes em 24 horas. E se você está começando um projeto novo, a faixa abaixo de US$ 0,50 por milhão de tokens de saída ficou mais populosa hoje do que estava ontem.

Em uma frase

Repasse do dia derruba o MiniMax M2.5 pela metade e barateia cinco modelos — se você roda M2.5, M2.7 ou gpt-oss-120b em volume, refaça a conta antes de fechar o mês.

Perguntas frequentes

Qual modelo ficou mais barato hoje?

O MiniMax M2.5, que viu o token de saída cair de US$ 0,90 para US$ 0,48 por milhão — quase metade do preço de ontem. O M2.7, da mesma casa, também cedeu 25% na saída.

Algum modelo subiu de preço hoje?

Sim, o DeepSeek V4 Flash. Ele apareceu duas vezes na lista: primeiro caiu, depois voltou a subir, terminando o dia 24% mais caro na saída do que pela manhã.

Os modelos de fronteira (Claude, Gemini, GPT) mudaram de preço?

Não. Os cinco mais bem colocados em inteligência hoje — Claude Fable 5, Z.ai GLM 5.2, Gemini 3.1 Pro Preview, Gemini 3.5 Flash e GPT-5.3-Codex — não aparecem na lista de repasses de 25 de junho de 2026.

Leia também