GLM 4.7 estreou há sete dias sem nota de inteligência — vale trocar de provedor?
Z.ai promete agente e programação mais estáveis; enquanto o catálogo não medir, a comparação com Claude Haiku 4.5 e Xiaomi MiMo-V2-Flash fica por conta do release.
Sete dias depois, o catálogo ainda não mediu
A Z.ai soltou o GLM 4.7 em 22 de dezembro de 2025. Hoje, 29 de dezembro, são sete dias de mercado — e nada de pontuação de inteligência publicada no catálogo. Em um mercado que tem 313 modelos listados nesta data, vindos de 48 criadores diferentes, isso não é detalhe: é exatamente a informação que desenvolvedores consultam antes de mexer em orçamento de API.
Para efeitos práticos, o catálogo trata o GLM 4.7 como um modelo com promessa forte em agente e programação, mas sem número para colocar lado a lado com Claude Haiku 4.5, OpenAI o3 ou Xiaomi MiMo-V2-Flash, que ocupam o topo da medição atual. Você está apostando na ficha do lançamento, não em benchmark independente disponível hoje.
O que a Z.ai promete — e o que isso quer dizer na prática
O release destaca duas frentes: capacidade de programação mais robusta e raciocínio/execução multi-etapas mais estável. Traduzindo do marketing para o código: tarefas agentes mais longas, menos alucinação no meio do caminho, leitura de repositórios complexos sem perder o fio. É exatamente o terreno onde o Claude Haiku 4.5 tem sido forte, e onde os modelos menores já estão incomodando.
A ficha que está na mesa é esta: contexto de 204.800 tokens (cabe boa parte de um repositório em uma única janela), modalidade exclusivamente texto-para-texto, preço de US$ 0,40 por milhão de tokens de entrada, US$ 1,75 por milhão de tokens de saída e cache a US$ 0,08 por milhão. Não é free, então antes de integrar é preciso colocar isso na planilha.
| Campo | Valor |
|---|---|
| Identificador | z-ai/glm-4.7 |
| Criador | z-ai |
| Preço de entrada | US$ 0.400 / M tokens |
| Preço de saída | US$ 1.75 / M tokens |
| Janela de contexto | 205k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.080 / M (80% de desconto) |
Onde ele entra olhando o resto da prateleira
Compare com quem joga na mesma faixa de preço e proposta hoje, 29 de dezembro:
- Xiaomi MiMo-V2-Flash: topo do índice de inteligência atual, com IQ 34.024, cobrando US$ 0,30 por milhão de tokens de saída. Mais barato e melhor ranqueado, mas sem o mesmo foco declarado em agente.
- OpenAI gpt-oss-120b: US$ 0,17 por milhão na saída, IQ 24.126, e com pesos abertos. É o "barato com transparência" — outro alvo natural do GLM 4.7.
- Claude Haiku 4.5: US$ 5,00 por milhão na saída, IQ 29.892. Aqui o GLM 4.7 pode competir de verdade em tarefas de programação, cobrando menos de metade. Se a promessa de raciocínio multi-etapas se confirmar, é a dor de cabeça real da Anthropic nessa faixa.
- Mistral Devstral 2 2512: US$ 2,00 por milhão na saída, IQ 19.242, foco em dev com nota mais baixa.
Em resumo: o GLM 4.7 chega mais caro na saída que Xiaomi e gpt-oss-120b, mas bem abaixo do Claude Haiku 4.5. A briga real é pela fatia Haiku, não pela fatia MiMo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Para quem vale — e para quem é besteira integrar
Vale a pena testar se: você já gasta com Claude Haiku 4.5 e quer munição para renegociação; sua carga é agente ou programação pesada; você pode tirar uma semana para rodar avaliação interna antes de decidir.
Não muda nada se: você já está feliz com gpt-oss-120b (mais barato, aberto); sua carga é raciocínio puro e você quer benchmark publicado na ponta; você precisa de multimodalidade — o catálogo lista text→text, só; ou você só quer o topo absoluto do índice, que segue sendo Xiaomi MiMo-V2-Flash.
O que falta decidir antes de trocar de provedor
Em sete dias de mercado, o GLM 4.7 não publicou índice de inteligência nem benchmark de coding ou agentic independente. Isso é nota de avaliação, não veredito: até o catálogo publicar uma nota, a decisão racional é rodar a sua própria carga (seus prompts, suas métricas) por alguns dias antes de cortar Haiku.
Se você só precisa colocar algo em produção hoje sem teste, fica com Haiku. Se dá para gastar uma semana avaliando, o GLM 4.7 é candidato sério — em especial pelo preço do cache a US$ 0,08, que em workloads de leitura repetida de código paga a conta no fim do mês.
Até sair benchmark independente, rode o GLM 4.7 por alguns dias na sua carga antes de cortar Claude Haiku 4.5 — mas o preço de cache e a proposta de agente fazem dele candidato real para esse swap.
Perguntas frequentes
O GLM 4.7 tem benchmark de inteligência publicado?
Não em 29 de dezembro de 2025. O catálogo mantém os campos de IQ, coding e agentic em branco para esse modelo, então a comparação com Claude Haiku 4.5 ou Xiaomi MiMo-V2-Flash só pode ser feita por preço e descrição do lançamento.
GLM 4.7 é mais barato que Claude Haiku 4.5?
Sim, na saída custa US$ 1,75 contra US$ 5,00 por milhão de tokens — quase um terço do preço. Sem benchmark público, porém, é cedo para cravar equivalência de qualidade.
Quando o GLM 4.7 faz sentido sobre o gpt-oss-120b?
O gpt-oss-120b cobra menos (US$ 0,17 por milhão na saída) e tem pesos abertos. O GLM 4.7 só vence se você precisar de execução agente mais longa e não se importar em esperar benchmark independente da sua própria avaliação.