Ternary Bonsai custa US$ 0,075, mas GLM 5.3 traz 1 milhão de contexto
Os dois modelos estreiam no catálogo com propostas diferentes: preço baixo para o Ternary Bonsai 2 e janela extensa para o GLM 5.3 FlashX. Nenhum dos dois tem nota de inteligência, código ou uso agêntico registrada.
Se você paga a conta da API, os dois lançamentos de 18 de setembro não disputam exatamente a mesma vaga. O PrismML Ternary Bonsai 2 27B entra no OpenRouter cobrando US$ 0,075 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. O Z.ai GLM 5.3 FlashX chega a US$ 0,37 na entrada e US$ 1,25 na saída, mas oferece uma janela de contexto de 1.048.576 tokens.
A diferença é prática: o Bonsai custa quase cinco vezes menos na entrada, enquanto o GLM alcança uma escala de contexto que pode dispensar cortes e resumos em tarefas com documentos longos. O anúncio de opções mais eficientes, portanto, depende do que pesa na sua fatura: volume de tokens ou tamanho do prompt.
O preço baixo está no Ternary Bonsai
O Ternary Bonsai 2 27B é a opção agressiva para quem processa muito texto e não precisa manter centenas de milhares de tokens em uma única chamada. A janela de contexto é de 262.144 tokens — quatro vezes menor que a do GLM 5.3 FlashX —, mas o preço de entrada listado no OpenRouter é de US$ 0,075 por milhão.
Na saída, o modelo custa US$ 0,50 por milhão de tokens. Isso coloca a opção em uma faixa voltada a classificação, transformação de texto, extração e outras rotinas em que o custo por requisição importa mais do que uma janela extrema.
O nome 27B aparece na identificação do modelo, mas não há registro de parâmetros, pesos abertos ou país de origem nos dados disponíveis. Também não há notas do Artificial Analysis para inteligência, código ou uso agêntico. Não dá para transformar o preço em promessa de qualidade.
O GLM vende espaço, não economia
O GLM 5.3 FlashX tem a principal vantagem em outro ponto: 1.048.576 tokens de contexto. A mesma escala aparece no Anthropic Claude Opus 4.8, no DeepSeek V4.1 Flash e no Google Gemini 3.8 Flash, segundo os preços e janelas listados no OpenRouter.
Isso não torna o GLM automaticamente a alternativa mais barata para contexto longo. O DeepSeek V4.1 Flash custa US$ 0,15 por milhão de tokens de entrada e US$ 0,60 na saída. O Claude Opus 4.8 cobra US$ 5 na entrada e US$ 25 na saída, enquanto o Gemini 3.8 Flash fica em US$ 0,75 e US$ 3,75, respectivamente.
O GLM 5.3 FlashX fica no meio dessa disputa de preço, com US$ 0,37 na entrada e US$ 1,25 na saída. Para uma aplicação que realmente envia prompts próximos de 1 milhão de tokens, a janela pode valer mais do que escolher o menor preço unitário. Para chamadas curtas, a capacidade fica subutilizada e a comparação volta a ser dominada pelo custo.
O que muda para quem escolhe modelo
Para quem opera atendimento, enriquecimento de dados ou pipelines de texto em grande volume, o Ternary Bonsai 2 merece teste de custo e qualidade. O preço de entrada é inferior ao do GLM 5.3 FlashX, ao do DeepSeek V4.1 Flash e ao do Gemini 3.8 Flash. A economia, porém, precisa ser medida junto com a taxa de erro e a necessidade de repetir chamadas — métricas que não aparecem nos dados disponíveis.
Para quem resume repositórios, contratos, históricos ou conjuntos extensos de documentos em uma única chamada, o GLM 5.3 FlashX é o lançamento mais relevante. A capacidade de 1.048.576 tokens elimina uma limitação que o Bonsai mantém em 262.144 tokens.
Para quem procura evidência de desempenho, os lançamentos ainda não oferecem esse sinal no Artificial Analysis: IQ, código e uso agêntico aparecem sem valores registrados. As quatro estreias recentes no índice são da família K2 Horizon, não do Ternary Bonsai 2 nem do GLM 5.3 FlashX.
A fatura continua dependendo do padrão de uso
O catálogo do OpenRouter reúne 604 modelos de 73 criadores, e os preços continuam mudando. Em 19 de setembro, por exemplo, o DeepSeek V4 Pro 0423 passou de US$ 3,20 para US$ 1,149 por milhão de tokens de entrada, enquanto o DeepSeek V4 Flash 0731 subiu de US$ 0,12 para US$ 0,18.
Esse ambiente torna perigoso escolher apenas pelo preço publicado no dia. Se você usa o Ternary Bonsai em produção, o ganho está no volume barato de entrada dentro de uma janela menor. Se precisa de contexto máximo, o GLM 5.3 FlashX entrega a capacidade, mas cobra mais e ainda não tem nota de benchmark registrada para justificar uma troca automática.
Escolha o Ternary Bonsai 2 para reduzir custo em prompts menores e teste o GLM 5.3 FlashX apenas quando a janela de 1.048.576 tokens resolver uma limitação real.
Perguntas frequentes
Quanto custa o Ternary Bonsai 2 27B na API?
O preço listado no OpenRouter é de US$ 0,075 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída. A janela de contexto é de 262.144 tokens.
O GLM 5.3 FlashX tem contexto de 1 milhão de tokens?
Sim. O OpenRouter lista 1.048.576 tokens de contexto para o modelo. A entrada custa US$ 0,37 por milhão de tokens e a saída, US$ 1,25.
Qual dos dois modelos é melhor para produção?
Os dados disponíveis não trazem notas de inteligência, código ou uso agêntico para nenhum dos dois. O Ternary Bonsai 2 favorece custo e o GLM 5.3 FlashX favorece contexto, então a escolha depende do padrão das requisições.