FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Dois lançamentos no mesmo dia, 50 vezes de distância no preço

Z.ai publicou GLM 5.1 a US$ 3 por milhão de tokens de saída; Anthropic respondeu com Claude Opus 4.6 Fast a US$ 150 em 7 de abril.

Redação FalaVIP IA 3 min de leitura
US$ 3,04por milhão de tokens de saída do GLM 5.1
US$ 150por milhão de tokens de saída do Claude Opus 4.6 Fast
0mudanças de preço no catálogo na semana

Dois lançamentos, 50 vezes de distância

Sete de abril colocou dois modelos novos no catálogo, e o preço por milhão de tokens de saída não podia ser mais oposto: US$ 3,04 contra US$ 150. São quase 50 vezes de diferença entre uma chamada e outra, vindas do mesmo dia e do mesmo painel.

Lançamentos entre 2026-04-06 e 2026-04-12
DataModeloCriadorInteligênciaSaída US$/M
2026-04-07GLM 5.1z-ai3.036
2026-04-07Claude Opus 4.6 (Fast)anthropic150

O GLM 5.1 entra na prateleira barata, ao lado do MiMo-V2-Omni da Xiaomi (US$ 2 por milhão) e do Qwen3.5 397B A17B (US$ 2,34). É a turma chinesa abaixo dos US$ 5 por milhão, agora com mais um representante. O Claude Opus 4.6 (Fast) entra em outro clube: o dos US$ 100 ou mais por milhão, ocupado por variantes premium de modelo grande voltadas a baixa latência.

O que se sabe — e o que ainda não

Nenhum dos dois apareceu com IQ medido no catálogo. Isso é comum em lançamento recente: o índice leva um tempo para ser calculado e validado. Por ora, o preço é o único dado comparável, e ele já diz bastante: se você precisa de algo "caro mas rápido", Opus 4.6 Fast é a única opção nova da semana. Se quer pagar pouco e topar testar modelo recém-chegado, GLM 5.1 está lá por menos do que custa um café por milhão de tokens.

A pergunta que fica é o que cada um entrega de fato. Sem IQ no painel, você está decidindo pelo preço — e, em parte, pelo histórico do criador.

Semana sem mexer em preço

Lançamentos da semana por criador
z-ai1anthropic1modelos

A semana de 6 a 12 de abril fechou com zero mudança de preço no catálogo. Zero corte, zero alta. Em um mercado que costuma mexer em tabela a cada semana, é pausa incomum. O fato concreto é este: 28 modelos foram listados nos últimos 30 dias, em um catálogo que passa de 390 modelos distribuídos por 54 criadores. O ritmo de novos entrantes continua alto, mesmo com a tabela de preços congelada.

O topo, e quanto custa chegar lá

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 390 modelos disponíveis no catálogo nesta data.

Se você precisa de IQ acima de 45, a lista cabe em dois nomes: Gemini 3.1 Pro Preview, da Google, a US$ 12 por milhão de tokens de saída; e GPT-5.3-Codex, da OpenAI, a US$ 14. Os dois mais baratos acima de IQ 45 custam quase o mesmo. O terceiro colocado, MiMo-V2-Omni da Xiaomi, já cai para IQ 35,866 — diferença grande para o segundo andar, ainda que continue sendo o mais barato entre os dez primeiros com folga.

Na prática, o catálogo está com um desenho claro: dois andares de topo (acima de IQ 45, premium), um meio cheio de modelos chineses baratos (MiMo, Qwen, agora GLM 5.1), e o resto entre US$ 10 e US$ 30 por milhão, onde a maioria das aplicações de produção se encaixa sem susto na fatura.

O que fazer com essa semana

Se o seu caso de uso roda bem com MiMo-V2-Omni ou Qwen3.5 397B A17B, os lançamentos da semana não mudam nada — você continua no clube dos US$ 2 a US$ 3 por milhão. Se você precisa do topo, o tabuleiro segue o mesmo: Google e OpenAI dominam, e a briga é por centavos entre US$ 12 e US$ 14.

A novidade real da semana foi a dissonância entre os dois lançamentos. Z.ai disse "cabe no orçamento"; Anthropic disse "cabe no orçamento de quem não confere o boleto". Quem confere vai tratar cada um como ferramenta para problema diferente — e não como substituto um do outro.

Em uma frase

Se o seu caso de uso cabe no andar de cima do IQ, ignore os dois lançamentos da semana; se cabe no andar chinês barato, teste GLM 5.1 como terceira opção abaixo dos US$ 5 por milhão; se precisa de baixa latência premium, Opus 4.6 Fast é o único novo entrante qualificado — e custa o que custa.

Perguntas frequentes

Z.ai GLM 5.1 já tem IQ medido no catálogo?

Não. O GLM 5.1 foi listado em 7 de abril de 2026 e ainda não tem IQ publicado, o que é comum para modelos recém-chegados. Por ora, o único dado comparável é o preço: US$ 3,04 por milhão de tokens de saída.

Por que Claude Opus 4.6 Fast custa quase 50 vezes mais que GLM 5.1?

Porque ocupam andares diferentes do catálogo. Opus 4.6 (Fast) é variante premium da Anthropic voltada a baixa latência e entra na faixa de US$ 150 por milhão de tokens de saída. GLM 5.1, da Z.ai, entra na faixa chinesa barata, abaixo de US$ 5 por milhão, ao lado de MiMo e Qwen.

Qual é o modelo mais barato acima de IQ 45 hoje?

Gemini 3.1 Pro Preview, da Google, a US$ 12 por milhão de tokens de saída, com IQ 47,738. O segundo mais barato acima de IQ 45 é GPT-5.3-Codex, da OpenAI, a US$ 14. Abaixo desse andar, o terceiro colocado (MiMo-V2-Omni, da Xiaomi) já cai para IQ 35,866.

Leia também