Cinco modelos ficaram mais baratos e um ficou mais caro em 24 horas
Repasse de preço do dia derruba saída do MiniMax M2.5 pela metade e mexe em seis modelos — vale trocar de cavalo?
Seis modelos mexeram no preço entre ontem e hoje. Cinco caíram, um subiu. Parece pouco, mas é o tipo de movimento que muda a conta de quem roda lote de inferência todo mês — e a maioria das mudanças veio de fabricantes chineses e de pesos abertos.
O corte do dia é do MiniMax M2.5
O destaque negativo do repasse — no bom sentido para o seu bolso — é o MiniMax: MiniMax M2.5. O token de saída caiu de US$ 0,90 para US$ 0,48 por milhão. Isso é quase metade do que custava ontem (queda de 47%). O de entrada também cedeu, de US$ 0,15 para US$ 0,12. Para quem usa o modelo em tarefas com muito texto gerado — resumo, classificação, agentes — o efeito na fatura é imediato.
O M2.7, da mesma casa, também entrou na dança: saída de US$ 0,96 para US$ 0,72 (corte de 25%) e entrada de US$ 0,24 para US$ 0,18. É o tipo de ajuste que costuma indicar reposicionamento de catálogo — o M2.7 está sendo empurrado para baixo na pirâmide, abrindo espaço para o irmão mais novo.
O único que subiu foi o DeepSeek V4 Flash
Olha que detalhe: o DeepSeek V4 Flash aparece duas vezes na lista de hoje. Primeiro caiu — saída de US$ 0,224 para US$ 0,180 e entrada de US$ 0,089 para US$ 0,090. Depois voltou a subir — saída de US$ 0,180 para US$ 0,224 e entrada de US$ 0,090 para US$ 0,089. É o típico ajuste de ida e volta em que o provedor corrige um repasse anterior. Para o usuário final, a mensagem é: o preço de tabela do Flash hoje é o do segundo movimento, ou seja, mais caro que o da manhã.
Não é um estouro — a alta líquida do Flash é de 24% na saída — mas é a única alta do dia. Tudo o mais caiu.
OpenAI e NVIDIA também cederam
O gpt-oss-120b, da OpenAI, viu a entrada cair de US$ 0,039 para US$ 0,030 por milhão e a saída ir de US$ 0,180 para US$ 0,150. É um corte pequeno em pontos percentuais, mas em um modelo de pesos abertos com 120 bilhões de parâmetros é o tipo de ajuste que faz diferença em cargas com muito prompt.
A NVIDIA entrou no movimento com o Nemotron 3 Super 120B-A12B: entrada de US$ 0,090 para US$ 0,085 e saída de US$ 0,450 para US$ 0,400. Corte modesto, de 11% na saída, mas coerente com a tendência do dia.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| MiniMax M2.5 | 0.9 | 0.48 | -47% |
| MiniMax M2.7 | 0.96 | 0.72 | -25% |
| DeepSeek V4 Flash 0423 | 0.224 | 0.18 | -20% |
| DeepSeek V4 Flash 0423 | 0.18 | 0.224 | +24% |
| gpt-oss-120b | 0.18 | 0.15 | -17% |
| Nemotron 3 Super | 0.45 | 0.4 | -11% |
Para quem isso muda a conta — e para quem não muda nada
Vale repensar se: você roda o MiniMax M2.5 ou M2.7 em produção com volume alto de saída. O corte de 47% no M2.5 é grande o suficiente para rebalancear a escolha entre ele e alternativas mais baratas do catálogo.
Não muda nada se: você consome poucos tokens por mês ou já está em um modelo de fronteira. O topo de inteligência continua o mesmo: Claude Fable 5, da Anthropic, lidera com folga (IQ 62), seguido por Z.ai GLM 5.2 e pelos Google Gemini 3.1 Pro Preview e 3.5 Flash. Nenhum desses mexeu no preço.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GLM 5.2 | 52.6 | 3.036 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
O tabuleiro de preços mais baratos com IQ acima de 45
Quando você olha o recorte de modelos com IQ acima de 45 e menor custo de saída, o MiniMax M3 lidera a US$ 1,20 por milhão de tokens de saída — à frente do DeepSeek V4 Pro (US$ 1,74) e do Z.ai GLM 5.2 (US$ 3,036). Repasses como o de hoje tendem a apertar ainda mais essa faixa, porque os modelos que disputam a base da pirâmide são justamente os que ajustam preço com frequência.
O que fazer agora
Se você tem o M2.5 ou o M2.7 em produção, vale rodar uma comparação curta com a alternativa que já estava no seu shortlist — o corte pode ter invertido a relação custo-benefício. Para o DeepSeek V4 Flash, espere um dia antes de recalcular, porque o preço oscilou duas vezes em 24 horas. E se você está começando um projeto novo, a faixa abaixo de US$ 0,50 por milhão de tokens de saída ficou mais populosa hoje do que estava ontem.
Repasse do dia derruba o MiniMax M2.5 pela metade e barateia cinco modelos — se você roda M2.5, M2.7 ou gpt-oss-120b em volume, refaça a conta antes de fechar o mês.
Perguntas frequentes
Qual modelo ficou mais barato hoje?
O MiniMax M2.5, que viu o token de saída cair de US$ 0,90 para US$ 0,48 por milhão — quase metade do preço de ontem. O M2.7, da mesma casa, também cedeu 25% na saída.
Algum modelo subiu de preço hoje?
Sim, o DeepSeek V4 Flash. Ele apareceu duas vezes na lista: primeiro caiu, depois voltou a subir, terminando o dia 24% mais caro na saída do que pela manhã.
Os modelos de fronteira (Claude, Gemini, GPT) mudaram de preço?
Não. Os cinco mais bem colocados em inteligência hoje — Claude Fable 5, Z.ai GLM 5.2, Gemini 3.1 Pro Preview, Gemini 3.5 Flash e GPT-5.3-Codex — não aparecem na lista de repasses de 25 de junho de 2026.