FalaVIP IA o que os modelos custam,
medido todo dia
Lançamentos

GLM 5.3 FlashX chega a 1 milhão de tokens por US$ 1,25

O novo modelo combina contexto estendido com preço de entrada intermediário, enquanto o Ternary Bonsai 2 aposta no custo mínimo. Nenhum dos dois estreia com nota de inteligência, código ou uso agêntico disponível.

Redação FalaVIP IA 4 min de leitura
1.048.576 tokensjanela de contexto do GLM 5.3 FlashX
US$ 0,075por milhão de tokens de entrada do Ternary Bonsai 2
US$ 1,25por milhão de tokens de saída do GLM 5.3 FlashX

O GLM 5.3 FlashX estreou no OpenRouter com uma janela de contexto de 1.048.576 tokens e preço de US$ 0,37 por milhão de tokens de entrada e US$ 1,25 por milhão de tokens de saída. No mesmo dia, o PrismML Ternary Bonsai 2 27B chegou cobrando US$ 0,075 na entrada e US$ 0,50 na saída, mas com contexto de 262.144 tokens.

A diferença muda a escolha: o GLM é a opção para quem precisa empilhar documentos, histórico ou instruções longas em uma única chamada; o Bonsai 2 é a aposta de menor custo entre os dois. A janela maior não vem acompanhada, nos dados disponíveis, de uma nota que prove desempenho superior.

O que realmente chegou ao catálogo

Os dois modelos foram listados em 18 de setembro de 2026. O GLM 5.3 FlashX é da Z.ai. O Ternary Bonsai 2 27B é da PrismML. O primeiro oferece contexto de 1.048.576 tokens. O segundo fica em 262.144 tokens, uma janela quatro vezes menor.

Na prática, você paga mais pelo GLM tanto na entrada quanto na saída. Ainda assim, o preço está distante de modelos de contexto equivalente. O DeepSeek V4.1 Flash, também listado no OpenRouter com 1.048.576 tokens de contexto, custa US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. O GLM custa mais na entrada e mais na saída que essa alternativa.

A comparação com modelos premium é ainda mais clara. O Claude Opus 4.8 tem a mesma janela de 1 milhão de tokens, mas aparece com US$ 5 por milhão na entrada e US$ 25 na saída. O GPT-5.4 tem contexto de 1.050.000 tokens, com preços de US$ 2,50 e US$ 15, respectivamente. O Gemini 3.8 Flash também chega a 1.048.576 tokens, por US$ 0,75 na entrada e US$ 3,75 na saída.

O Bonsai 2 joga outro jogo

O Ternary Bonsai 2 27B não compete diretamente pela maior janela. Seu argumento é o preço de entrada: US$ 0,075 por milhão de tokens. A saída custa US$ 0,50 por milhão.

Esse perfil serve para classificação, extração, resumo e respostas com prompts que cabem confortavelmente em 262.144 tokens. Se sua aplicação envia grandes históricos, repositórios extensos ou conjuntos de documentos em uma só requisição, a janela do GLM oferece mais espaço e pode evitar cortes ou divisão do trabalho.

O número “27B” faz parte do nome do modelo, mas não há, nos dados disponíveis, confirmação independente sobre parâmetros, pesos abertos ou país de origem. Também não há nota de inteligência, código ou desempenho agêntico para qualquer um dos dois lançamentos. Portanto, preço e contexto são os sinais concretos; qualidade ainda precisa ser testada na sua carga de trabalho.

A conta do catálogo é menos estável

As estreias chegam em um dia de forte movimentação de preços. O OpenRouter registrou 20 mudanças em 18 de setembro, além dos três lançamentos do período. Entre elas, o OpenAI gpt-oss-120b passou de US$ 0,17 para US$ 0,60 por milhão de tokens de entrada, uma alta de 252,9%. O Meta Muse Glimmer 30B subiu de US$ 1,10 para US$ 1,50, enquanto o Kimi K3 caiu de US$ 15 para US$ 10,95.

Há uma complicação mais importante para quem automatiza a escolha do provedor: o próprio registro do dia mostra movimentos conflitantes para alguns modelos. O DeepSeek V4 Pro 0423 aparece tanto subindo de US$ 1,887 para US$ 3,20 quanto caindo de US$ 3,20 para US$ 1,887. O V4 Flash também aparece em registros de alta e de queda no mesmo período.

Isso significa que uma cotação feita hoje não deve ser tratada como contrato de longo prazo. Se a aplicação escolhe modelos por preço, registre o valor efetivo no momento da chamada e mantenha um limite de custo por rota.

Para quem cada estreia vale

O GLM 5.3 FlashX faz sentido para quem precisa de contexto de 1 milhão de tokens e não quer pagar os preços dos modelos premium. É especialmente relevante em análise de documentos longos, bases de código e fluxos com histórico extenso. Não há evidência disponível para dizer que ele é a melhor escolha em raciocínio, programação ou agentes.

O Ternary Bonsai 2 vale para quem prioriza custo de entrada e trabalha com prompts menores. Ele não muda nada para uma equipe que precisa manter mais de 262.144 tokens na mesma chamada. Também não há motivo, com os dados atuais, para migrar apenas por promessa de qualidade: nenhum índice do Artificial Analysis foi informado para os dois lançamentos.

O catálogo agora reúne 604 modelos de 73 criadores, mas variedade não elimina a necessidade de teste. Para quem paga a fatura, a decisão é objetiva: escolha o GLM quando o contexto for o gargalo; escolha o Bonsai 2 quando cada centavo da entrada pesar mais que o tamanho da janela.

Em uma frase

Se o seu gargalo é contexto, teste o GLM 5.3 FlashX; se é custo de entrada e o prompt cabe em 262.144 tokens, comece pelo Ternary Bonsai 2.

Perguntas frequentes

Quanto custa o GLM 5.3 FlashX no OpenRouter?

O GLM 5.3 FlashX custa US$ 0,37 por milhão de tokens de entrada e US$ 1,25 por milhão de tokens de saída. A janela de contexto é de 1.048.576 tokens.

Qual é a janela de contexto do Ternary Bonsai 2?

O PrismML Ternary Bonsai 2 27B tem contexto de 262.144 tokens. Ele custa US$ 0,075 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída.

GLM 5.3 FlashX e Ternary Bonsai 2 têm nota de benchmark?

Não nos dados disponíveis. Nenhum dos dois lançamentos tem índice informado de inteligência, código ou desempenho agêntico no Artificial Analysis.

Leia também