Hy-MT2 custa até US$ 0,295; Ox Alpha aparece a US$ 0
A Tencent adiciona versões de 1,8 bilhão e 30 bilhões de parâmetros ao catálogo, enquanto o modelo da stealth chega sem informações técnicas além do preço e do contexto.
Se você usa um modelo em produção, a diferença mais importante do dia está na fatura: o Hy-MT2-30B-A3B cobra US$ 0,074 por milhão de tokens de entrada e US$ 0,295 por milhão de tokens de saída. O Ox Alpha, da stealth, aparece no OpenRouter com entrada e saída a US$ 0, além de uma janela de contexto de 1.048.576 tokens.
A Tencent também colocou no catálogo o Hy-MT2-1.8B, ainda mais barato na entrada, a US$ 0,044 por milhão de tokens, e com saída a US$ 0,177. Os três modelos estão listados como lançamentos de 20 de agosto de 2026. O ganho para quem escolhe por custo é claro. A ressalva é que o preço do Ox Alpha vem acompanhado de pouca informação para avaliar risco técnico.
Dois Hy-MT2, uma escolha de custo
As duas opções da Tencent têm a mesma janela de contexto: 8.192 tokens. Isso limita o tipo de aplicação em que elas entram. Para classificação, extração, respostas curtas e automações com prompts compactos, esse espaço pode ser suficiente. Para documentos longos, históricos extensos ou agentes que acumulam muitas etapas, a restrição pesa mais.
O Hy-MT2-1.8B é a alternativa de menor custo entre os dois. Você paga US$ 0,044 por milhão de tokens processados na entrada e US$ 0,177 por milhão gerado na saída. Já o Hy-MT2-30B-A3B custa mais, mas ainda fica abaixo de US$ 0,30 por milhão de tokens de saída.
Não há, nos dados do Artificial Analysis, notas de inteligência, código ou desempenho agêntico para nenhum dos dois. Também não há indicação de parâmetros, pesos abertos ou país de origem. Portanto, não dá para transformar a diferença de preço em uma conclusão sobre qualidade.
Ox Alpha é barato, mas a ficha está vazia
O Ox Alpha aparece com preço de US$ 0 para entrada e saída. Na prática, isso pode chamar atenção para testes, protótipos e aplicações de alto volume. Mas preço zerado não informa limite de uso, estabilidade, latência, política de retenção ou qualidade das respostas.
A única especificação técnica registrada é a janela de contexto de 1.048.576 tokens. É uma capacidade muito maior que a dos Hy-MT2 e pode interessar a quem precisa enviar arquivos ou históricos extensos em uma única chamada. Ainda assim, o catálogo não traz notas de inteligência, código ou uso agêntico para o modelo.
Se você precisa colocar um sistema em produção hoje, trate o Ox Alpha como candidato a avaliação, não como substituto automático de um modelo já validado. O custo de inferência é apenas uma parte da conta. Falhas, respostas inconsistentes e necessidade de repetir chamadas também consomem orçamento.
O mercado também mexeu nos preços
Os lançamentos chegam em um catálogo que já soma 555 modelos de 70 criadores, segundo os registros do dia. Ao mesmo tempo, houve alterações relevantes em opções conhecidas. O Qwen3.6 27B passou de US$ 2 para US$ 3,60 por milhão de tokens, uma alta de 80%. O DeepSeek V4 Pro 0813 subiu de US$ 1,98 para US$ 3,564, também 80%.
O Kimi K2.6 aparece com movimentos conflitantes no mesmo dia: uma alteração registra alta de US$ 2,36 para US$ 4, enquanto outra registra queda de US$ 3,96 para US$ 2,36. Essa divergência importa para quem calcula custo com base em uma rota específica. Antes de trocar o modelo, confira o preço vigente no endpoint usado pela aplicação.
Também houve ajustes menores no DeepSeek V4 Pro 0423, de US$ 2,88 para US$ 3,20, e em variantes do DeepSeek V4 Flash. A existência de modelos baratos não impede que uma opção já adotada fique mais cara de uma hora para outra.
Para quem vale a troca
O Hy-MT2-1.8B faz mais sentido para cargas simples e sensíveis a custo, desde que 8.192 tokens bastem para o prompt e a resposta. O Hy-MT2-30B-A3B pode ser testado quando você precisa de uma alternativa intermediária, mas não tem benchmark disponível para confirmar vantagem de qualidade.
O Ox Alpha interessa principalmente a quem quer experimentar uma janela longa sem pagar pelos tokens listados. Ele não muda nada para equipes que precisam de métricas comparáveis, documentação técnica ou previsibilidade operacional antes de liberar um modelo para usuários finais.
A decisão prática é separar experimentação de produção: teste os Hy-MT2 com prompts reais e monitore a janela de contexto; avalie o Ox Alpha com limites, repetição e fallback. A economia só aparece na fatura quando o modelo barato entrega a resposta certa na primeira tentativa.
Use os Hy-MT2 para testar cargas curtas de baixo custo e reserve o Ox Alpha para avaliação controlada até que sua qualidade e operação estejam comprovadas.
Perguntas frequentes
Quanto custa o Tencent Hy-MT2-30B-A3B?
No OpenRouter, o modelo custa US$ 0,074 por milhão de tokens de entrada e US$ 0,295 por milhão de tokens de saída. A janela de contexto é de 8.192 tokens.
O Ox Alpha é gratuito para usar em produção?
O OpenRouter lista entrada e saída a US$ 0 por milhão de tokens. Isso não informa limites, disponibilidade ou qualidade, então o modelo deve ser validado antes de assumir uma carga de produção.
Qual é a janela de contexto do Hy-MT2?
Tanto o Hy-MT2-1.8B quanto o Hy-MT2-30B-A3B têm janela de contexto de 8.192 tokens. O Ox Alpha aparece com 1.048.576 tokens.