Sete dias, sete modelos e zero corte de preço: o que ficou caro e o que ficou grátis
A semana fechou com lançamentos da Z.ai, OpenAI, LiquidAI, Writer e MiniMax — e nenhum ajuste de tabela. O fio condutor é a corrida pelo áudio e pelos modelos de borda.
A semana que não mexeu na fatura
Sete lançamentos, zero mudança de tabela. Se você acompanha preço de API, a semana de 19 a 25 de janeiro foi daquelas em que a fatura de fevereiro vai olhar basicamente para o volume de chamadas — não para um corte ou um aumento que chegou de surpresa. O catálogo seguiu crescendo em quantidade, e os preços antigos continuam valendo.
Isso é informação, não ausência dela. Quando ninguém mexe na régua, o que muda é a prateleira: novos modelos disputando o mesmo orçamento. E o padrão dessa semana foi bem claro.
O áudio virou produto de prateleira
A OpenAI entrou com dois lançamentos no mesmo dia, 19 de janeiro, e os dois são de áudio. O GPT Audio Mini sai por US$ 2,40 por milhão de tokens de saída; o GPT Audio completo, US$ 10 por milhão de tokens de saída. Traduzindo o que isso significa na conta: o Mini é quatro vezes mais barato que o modelo cheio, mas o modelo cheio é o que entrega a qualidade de produção. Se você está montando um atendimento por voz ou uma transcrição com geração de fala, a diferença entre US$ 2,40 e US$ 10 por milhão é a diferença entre um protótipo e um produto que roda em escala.
Para quem já tinha um workflow de voz rodando, isso muda alguma coisa? Depende. Se você usava o Realtime API, agora tem uma alternativa de áudio mais barata e segmentada por tamanho. Se você só transcreve, ainda há caminhos mais em conta com modelos Whisper dedicados — mas o GPT Audio é um produto unificado, e unificação tem valor quando você quer uma única fatura.
A Z.ai abriu a semana com um Flash
No mesmo 19 de janeiro, a Z.ai soltou o GLM 4.7 Flash a US$ 0,40 por milhão de tokens de saída. É um modelo chinês brigando na faixa dos US$ 0,30 a US$ 0,50 onde mora o MiMo-V2-Flash da Xiaomi, hoje o topo de inteligência do catálogo com IQ 34,024. O Flash da Z.ai ainda não tem nota de inteligência publicada, então não dá para dizer se ele entra nesse clube — mas o preço diz a intenção: brigar pela atenção de quem roteiriza chamadas entre modelos.
LiquidAI apostou em grátis — e em pequeno
Dois dias depois, a LiquidAI colocou no catálogo dois modelos com a tag :free: o LFM2.5-1.2B-Instruct e o LFM2.5-1.2B-Thinking. Ambos a US$ 0,00 por milhão de tokens de saída. O IQ deles é baixo — 2,299 e 2,341 — mas a história aqui não é qualidade bruta. É custo marginal zero para tarefas que não exigem raciocínio pesado: classificação, extração simples, roteamento. Se você está pagando para um modelo de fronteira decidir se um e-mail é spam, está pagando demais.
Writer e MiniMax fecharam a semana
No dia 21, a Writer lançou o Palmyra X5 a US$ 6 por milhão de tokens de saída — preço de modelo empresarial, posicionamento claro. No dia 23, a MiniMax entrou com o MiniMax M2-her a US$ 1,20 por milhão, mais barato que o Claude Haiku 4.5 (US$ 5) e mais caro que o Devstral 2 (US$ 2). Sem nota de IQ publicada, é um ingresso esperando medição.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-01-19 | GLM 4.7 Flash | z-ai | — | 0.4 |
| 2026-01-19 | GPT Audio Mini | openai | — | 2.4 |
| 2026-01-19 | GPT Audio | openai | — | 10 |
| 2026-01-20 | LFM2.5-1.2B-Instruct (free) | liquid | 2.3 | 0 |
| 2026-01-20 | LFM2.5-1.2B-Thinking (free) | liquid | 2.3 | 0 |
| 2026-01-21 | Palmyra X5 | writer | — | 6 |
| 2026-01-23 | MiniMax M2-her | minimax | — | 1.2 |
O tabuleiro nesta segunda
Se você abrir o catálogo agora, vai encontrar 322 modelos listados, vindos de 50 criadores diferentes. O topo de inteligência segue dominado pelo MiMo-V2-Flash da Xiaomi (IQ 34,024), seguido pelo o3 da OpenAI (31,096) e pelo Claude Haiku 4.5 da Anthropic (29,892). Nenhum dos sete lançamentos desta semana aparece nessa lista — todos estão sem medição ou estão na faixa dos modelos pequenos.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Para quem isso importa — e para quem não
Se você está montando um pipeline de voz, a semana entregou opções reais com preço tabelado. Se você está procurando custo marginal zero para tarefas auxiliares, a LiquidAI te deu duas ferramentas grátis. Se você está atrás do modelo mais inteligente do mercado, nada desta semana muda o seu ranking — o topo segue sendo Xiaomi, OpenAI e Anthropic.
E se você está esperando um corte de preço? Não foi desta vez. A régua não se moveu.
A semana não mudou a régua de preço, mas mudou o cardápio: áudio tabelado pela OpenAI, modelo grátis da LiquidAI para tarefas auxiliares, e a Z.ai brigando na faixa dos US$ 0,40 — revise qual modelo está roteirizando cada chamada antes do próximo ciclo da fatura.
Perguntas frequentes
Algum modelo teve corte de preço na semana de 19 a 25 de janeiro de 2026?
Não. O catálogo registrou zero mudanças de preço no período. Todos os sete lançamentos chegaram com tabela nova, e os modelos antigos mantiveram os valores anteriores.
Quanto custa o GPT Audio da OpenAI?
O GPT Audio custa US$ 10 por milhão de tokens de saída, e a versão GPT Audio Mini custa US$ 2,40 por milhão de tokens de saída. Ambos foram lançados em 19 de janeiro de 2026.
Quais modelos gratuitos entraram no catálogo nesta semana?
A LiquidAI publicou dois modelos com preço zero por milhão de tokens de saída: o LFM2.5-1.2B-Instruct e o LFM2.5-1.2B-Thinking, ambos lançados em 20 de janeiro de 2026.