OpenAI cortou quatro modelos pela metade em um único dia
Sete modelos ficaram mais baratos ontem. Enquanto OpenAI e MoonshotAI cortam, Z.ai e Google sobem — e sua escolha de API muda.
Quatro modelos da OpenAI pela metade do preço em 24 horas. É o tipo de movimento que ninguém anuncia em coletiva, mas que muda a planilha de quem paga a API no fim do mês. Ontem o GPT-5.6 Terra custava US$ 15 por milhão de tokens de saída; hoje, US$ 7,50. O Luna saiu de US$ 6 para US$ 3. As versões Pro seguiram o mesmo corte de 50%. Enquanto isso, dois modelos — GLM 5.2 da Z.ai e Gemma 4 26B A4B do Google — fizeram o caminho oposto e ficaram mais caros.
O dia em que a OpenAI mexeu no meio do tabuleiro
No total, 9 modelos mudaram de preço entre ontem e hoje. Sete ficaram mais baratos. Dois, mais caros. A média do dia é deflação — mas o que importa é onde a tesoura cortou.
A OpenAI cortou exatamente o segmento onde a briga está mais feia: o meio de tabela. GPT-5.6 Terra, GPT-5.6 Luna e as variantes Pro de ambos, todos pela metade — input e output na mesma proporção. O Terra é um dos cinco modelos mais inteligentes do catálogo hoje (IQ 56,576) e custava o mesmo que o Kimi K3 da MoonshotAI. Agora custa metade. O Luna, que já estava na faixa dos "baratos com bom IQ" (IQ 52,318), virou um dos mais competitivos do mercado.
O que ficou mais barato — e por que isso importa
A MoonshotAI fez um movimento ainda mais agressivo com o Kimi Latest: zerou o preço. Saiu de US$ 3 por milhão de tokens de entrada e US$ 15 de saída para zero. Literalmente gratuito. É a jogada típica de quem está tentando ganhar tração num mercado onde o nome ainda não está consolidado — o preço era um empecilho, e tirar o empecilho é um convite para experimentar.
A NVIDIA também entrou na onda: Nemotron 3 Ultra caiu cerca de 39% no preço de saída, de US$ 3,60 para US$ 2,20 por milhão de tokens. Movimento pequeno no radar global, mas relevante para quem roda workloads específicos em hardware NVIDIA e quer manter o custo baixo.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| MoonshotAI Kimi Latest | 15 | 0 | -100% |
| GPT-5.6 Luna | 6 | 3 | -50% |
| GPT-5.6 Luna Pro | 6 | 3 | -50% |
| GPT-5.6 Terra | 15 | 7.5 | -50% |
| GPT-5.6 Terra Pro | 15 | 7.5 | -50% |
| Nemotron 3 Ultra | 3.6 | 2.2 | -39% |
| GLM 5.2 | 2.1032 | 2.5828 | +23% |
| Gemma 4 26B A4B | 0.35 | 0.42 | +20% |
Quem foi na contramão
Z.ai e Google subiram. O GLM 5.2 ficou cerca de 23% mais caro (de US$ 2,10 para US$ 2,58 por milhão de tokens de saída). O Gemma 4 26B A4B subiu cerca de 20%. Não é coincidência: são dois modelos que brigam em faixas específicas — Z.ai no segmento chinês de código, Gemma no open-weight enxuto — e cujos fornecedores não sentem a mesma pressão da OpenAI no segmento corporativo ocidental. Quando você não está sendo pressionado por concorrente direto, subir preço é razoável.
Onde isso te coloca
Se você já usa GPT-5.6 Terra ou Luna como modelo padrão de produção, faça as contas: sua fatura pode cair à metade sem perda significativa de qualidade no segmento de IQ 50-56. Se você está comparando com DeepSeek V4 Pro (US$ 1,74/M de saída) ou MiniMax M3 (US$ 1,20/M), o Luna agora entra na briga dos "baratos com bom IQ" a US$ 1,20/M de input e US$ 3,00/M de saída — antes era US$ 6,00/M de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
Se você estava pagando caro para acessar Kimi Latest especificamente, migre para Kimi K3 ou simplesmente consuma o Latest de graça enquanto ele estiver gratuito — modelos com sufixo "Latest" costumam ser substituídos por uma versão numerada.
Para quem usa Z.ai ou Gemma em produção: não há substituto imediato com o mesmo perfil. A pergunta é se o caso de uso compensa o novo patamar de preço, ou se vale considerar self-hosting em vez de pagar API.
O que ninguém te conta sobre corte de preço
Quando um fornecedor corta o preço pela metade, está sinalizando uma de três coisas: perdeu market share e está reagindo, está abrindo mão de margem para escalar volume, ou substituiu internamente o modelo por uma versão mais barata de rodar. Não existe almoço grátis — existe a chance de aproveitar a janela antes do preço ser reajustado.
Ontem o GPT-5.6 Terra era o "caro do meio". Hoje ele é o "barato do topo" da sua faixa de IQ. Esse tipo de inversão não costuma ficar disponível por muito tempo.
Revise hoje mesmo o custo do GPT-5.6 Terra ou Luna na sua fatura — quem usa esses modelos em volume pode cortar a conta pela metade sem trocar de fornecedor; quem usa Z.ai ou Gemma precisa decidir se aceita o novo patamar ou migra.
Perguntas frequentes
Por que a OpenAI cortou o preço do Terra e do Luna pela metade?
Não houve comunicado oficial explicando o motivo. No padrão do setor, cortes assim costumam acontecer quando o fornecedor está perdendo market share para concorrentes (no caso, DeepSeek e MoonshotAI na faixa intermediária), quer escalar volume abrindo mão de margem, ou passou a rodar uma versão mais barata do modelo internamente.
O Kimi Latest ficar de graça é sustentável?
Modelos com sufixo "Latest" são versões ponte, geralmente substituídas por uma versão numerada em poucas semanas. Vale consumir de graça enquanto estiver disponível, mas não dá para contar com isso como estratégia permanente de custo.
O que fazer com um modelo que subiu de preço, como o GLM 5.2 e o Gemma 4?
Avalie se o caso de uso ainda compensa o novo preço. Como ambos têm perfil open-weight, vale rodar as contas de self-hosting — em muitos cenários, hospedar o modelo próprio sai mais barato do que pagar o novo valor de API.