FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

OpenAI cortou quatro modelos pela metade em um único dia

Sete modelos ficaram mais baratos ontem. Enquanto OpenAI e MoonshotAI cortam, Z.ai e Google sobem — e sua escolha de API muda.

Redação FalaVIP IA 3 min de leitura
US$ 7,50novo preço por milhão de tokens de saída do GPT-5.6 Terra (era US$ 15)
US$ 0preço por milhão de tokens do MoonshotAI Kimi Latest (era US$ 15)
7modelos ficaram mais baratos em 24 horas

Quatro modelos da OpenAI pela metade do preço em 24 horas. É o tipo de movimento que ninguém anuncia em coletiva, mas que muda a planilha de quem paga a API no fim do mês. Ontem o GPT-5.6 Terra custava US$ 15 por milhão de tokens de saída; hoje, US$ 7,50. O Luna saiu de US$ 6 para US$ 3. As versões Pro seguiram o mesmo corte de 50%. Enquanto isso, dois modelos — GLM 5.2 da Z.ai e Gemma 4 26B A4B do Google — fizeram o caminho oposto e ficaram mais caros.

O dia em que a OpenAI mexeu no meio do tabuleiro

No total, 9 modelos mudaram de preço entre ontem e hoje. Sete ficaram mais baratos. Dois, mais caros. A média do dia é deflação — mas o que importa é onde a tesoura cortou.

A OpenAI cortou exatamente o segmento onde a briga está mais feia: o meio de tabela. GPT-5.6 Terra, GPT-5.6 Luna e as variantes Pro de ambos, todos pela metade — input e output na mesma proporção. O Terra é um dos cinco modelos mais inteligentes do catálogo hoje (IQ 56,576) e custava o mesmo que o Kimi K3 da MoonshotAI. Agora custa metade. O Luna, que já estava na faixa dos "baratos com bom IQ" (IQ 52,318), virou um dos mais competitivos do mercado.

Variação do preço de saída (%)
MoonshotAI Kimi Latest-100GPT-5.6 Luna-50GPT-5.6 Luna Pro-50GPT-5.6 Terra-50GPT-5.6 Terra Pro-50Nemotron 3 Ultra-39GLM 5.223Gemma 4 26B A4B 20%

O que ficou mais barato — e por que isso importa

A MoonshotAI fez um movimento ainda mais agressivo com o Kimi Latest: zerou o preço. Saiu de US$ 3 por milhão de tokens de entrada e US$ 15 de saída para zero. Literalmente gratuito. É a jogada típica de quem está tentando ganhar tração num mercado onde o nome ainda não está consolidado — o preço era um empecilho, e tirar o empecilho é um convite para experimentar.

A NVIDIA também entrou na onda: Nemotron 3 Ultra caiu cerca de 39% no preço de saída, de US$ 3,60 para US$ 2,20 por milhão de tokens. Movimento pequeno no radar global, mas relevante para quem roda workloads específicos em hardware NVIDIA e quer manter o custo baixo.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
MoonshotAI Kimi Latest150-100%
GPT-5.6 Luna63-50%
GPT-5.6 Luna Pro63-50%
GPT-5.6 Terra157.5-50%
GPT-5.6 Terra Pro157.5-50%
Nemotron 3 Ultra3.62.2-39%
GLM 5.22.10322.5828+23%
Gemma 4 26B A4B 0.350.42+20%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Quem foi na contramão

Z.ai e Google subiram. O GLM 5.2 ficou cerca de 23% mais caro (de US$ 2,10 para US$ 2,58 por milhão de tokens de saída). O Gemma 4 26B A4B subiu cerca de 20%. Não é coincidência: são dois modelos que brigam em faixas específicas — Z.ai no segmento chinês de código, Gemma no open-weight enxuto — e cujos fornecedores não sentem a mesma pressão da OpenAI no segmento corporativo ocidental. Quando você não está sendo pressionado por concorrente direto, subir preço é razoável.

Onde isso te coloca

Se você já usa GPT-5.6 Terra ou Luna como modelo padrão de produção, faça as contas: sua fatura pode cair à metade sem perda significativa de qualidade no segmento de IQ 50-56. Se você está comparando com DeepSeek V4 Pro (US$ 1,74/M de saída) ou MiniMax M3 (US$ 1,20/M), o Luna agora entra na briga dos "baratos com bom IQ" a US$ 1,20/M de input e US$ 3,00/M de saída — antes era US$ 6,00/M de saída.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 522 modelos disponíveis no catálogo nesta data.

Se você estava pagando caro para acessar Kimi Latest especificamente, migre para Kimi K3 ou simplesmente consuma o Latest de graça enquanto ele estiver gratuito — modelos com sufixo "Latest" costumam ser substituídos por uma versão numerada.

Para quem usa Z.ai ou Gemma em produção: não há substituto imediato com o mesmo perfil. A pergunta é se o caso de uso compensa o novo patamar de preço, ou se vale considerar self-hosting em vez de pagar API.

O que ninguém te conta sobre corte de preço

Quando um fornecedor corta o preço pela metade, está sinalizando uma de três coisas: perdeu market share e está reagindo, está abrindo mão de margem para escalar volume, ou substituiu internamente o modelo por uma versão mais barata de rodar. Não existe almoço grátis — existe a chance de aproveitar a janela antes do preço ser reajustado.

Ontem o GPT-5.6 Terra era o "caro do meio". Hoje ele é o "barato do topo" da sua faixa de IQ. Esse tipo de inversão não costuma ficar disponível por muito tempo.

Em uma frase

Revise hoje mesmo o custo do GPT-5.6 Terra ou Luna na sua fatura — quem usa esses modelos em volume pode cortar a conta pela metade sem trocar de fornecedor; quem usa Z.ai ou Gemma precisa decidir se aceita o novo patamar ou migra.

Perguntas frequentes

Por que a OpenAI cortou o preço do Terra e do Luna pela metade?

Não houve comunicado oficial explicando o motivo. No padrão do setor, cortes assim costumam acontecer quando o fornecedor está perdendo market share para concorrentes (no caso, DeepSeek e MoonshotAI na faixa intermediária), quer escalar volume abrindo mão de margem, ou passou a rodar uma versão mais barata do modelo internamente.

O Kimi Latest ficar de graça é sustentável?

Modelos com sufixo "Latest" são versões ponte, geralmente substituídas por uma versão numerada em poucas semanas. Vale consumir de graça enquanto estiver disponível, mas não dá para contar com isso como estratégia permanente de custo.

O que fazer com um modelo que subiu de preço, como o GLM 5.2 e o Gemma 4?

Avalie se o caso de uso ainda compensa o novo preço. Como ambos têm perfil open-weight, vale rodar as contas de self-hosting — em muitos cenários, hospedar o modelo próprio sai mais barato do que pagar o novo valor de API.

Leia também