FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Tencent Hy4 preview chega com 1 milhão de tokens por US$ 2,501

O modelo estreia com contexto de 1.048.576 tokens e preço intermediário: custa mais que opções Flash, mas menos que modelos premium de contexto semelhante.

Redação FalaVIP IA 3 min de leitura
1.048.576 tokensjanela de contexto
US$ 0,834por milhão de tokens de entrada
US$ 2,501por milhão de tokens de saída

Se você usa modelos em produção, o número que importa no Tencent Hy4 preview é US$ 2,501 por milhão de tokens de saída. A entrada custa US$ 0,834 por milhão, e a janela de contexto chega a 1.048.576 tokens, segundo os preços e especificações listados no OpenRouter.

A estreia amplia as opções para enviar documentos muito extensos em uma única requisição. Mas o anúncio não transforma automaticamente o Hy4 em uma escolha superior: o Artificial Analysis ainda não registra notas de inteligência, código ou desempenho agêntico para o modelo.

O que mudou na prática

O Tencent Hy4 preview aparece no catálogo em 28 de agosto de 2026 com o identificador tencent/hy4-preview. O ponto central é a combinação de contexto de 1.048.576 tokens com cobrança por uso.

Para quem trabalha com contratos, históricos, bases de conhecimento ou repositórios extensos, isso pode reduzir a necessidade de dividir o material em partes menores. Menos fragmentação também pode simplificar o fluxo de recuperação e análise, desde que a aplicação consiga controlar o volume enviado e validar as respostas.

O termo “preview” também faz diferença. Ele identifica uma versão de prévia, não uma garantia de estabilidade ou de desempenho superior. Os dados disponíveis não trazem parâmetros, indicação de pesos abertos nem métricas de velocidade para o Hy4.

A conta fica no meio do caminho

O preço de entrada do Hy4 é maior que o do Google Gemini 2.5 Flash, listado no OpenRouter a US$ 0,3 por milhão de tokens de entrada. Na saída, os dois ficam próximos: o Gemini custa US$ 2,5 por milhão, contra US$ 2,501 do Hy4.

O Gemini 2.5 Flash Lite é mais barato, a US$ 0,1 por milhão de tokens de entrada e US$ 0,4 por milhão de saída, mantendo a mesma janela de contexto de 1.048.576 tokens. Para tarefas simples e repetitivas, essa diferença pesa mais na fatura do que o nome do modelo.

Há ainda uma alternativa em lote: o DeepSeek V4 Flash 0731 batch aparece com US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de saída, também com contexto de 1.048.576 tokens. A comparação, porém, não é direta: uma modalidade batch atende a outro tipo de operação e não deve ser tratada como substituta automática de chamadas interativas.

Contexto grande não é nota de inteligência

O Hy4 chega com uma janela equivalente à de outros modelos voltados a documentos longos, mas não há nota do Artificial Analysis para medir sua capacidade de raciocínio, programação ou uso agêntico. Também não há estreia em benchmarks registrada para o modelo.

Isso limita a decisão. Você pode saber quanto custa colocar um milhão de tokens no contexto, mas ainda não sabe, pelos dados disponíveis, como o Hy4 se compara em qualidade às alternativas. Uma janela maior resolve o limite de entrada; não prova que o modelo encontrará a informação certa, seguirá instruções complexas ou produzirá uma resposta confiável.

Essa ausência de métrica vale especialmente para equipes que precisam escolher um modelo para agentes, geração de código ou automação de processos. Nesses casos, preço e contexto são apenas parte da equação. O desempenho real do fluxo precisa ser medido com os próprios documentos, prompts e critérios de erro.

Para quem vale — e para quem não muda nada

O lançamento interessa a quem já precisa processar textos extensos via API e quer uma alternativa com contexto de 1.048.576 tokens. Também pode fazer sentido para quem aceita testar uma prévia e prefere pagar menos que modelos premium de contexto semelhante.

Para quem usa documentos menores, o Hy4 não oferece uma vantagem clara apenas por ter uma janela grande. O Gemini 2.5 Flash Lite custa menos na entrada e na saída, enquanto o DeepSeek V4 Flash 0731 batch pode reduzir bastante o custo em processamento não interativo.

Se a prioridade é inteligência comprovada, código ou agentes, o Hy4 também não muda a escolha por enquanto: as notas correspondentes estão ausentes no Artificial Analysis. A novidade é principalmente de capacidade de contexto e posicionamento de preço, não de benchmark.

Na prática, o Hy4 deve entrar primeiro como candidato a um teste controlado: envie seus documentos reais, compare custo por tarefa e só depois decida se a janela de 1.048.576 tokens compensa o preço de saída.

Em uma frase

O Tencent Hy4 preview vale testar para documentos extensos, mas a falta de benchmarks impede tratá-lo como escolha definitiva para produção.

Perguntas frequentes

Quanto custa usar o Tencent Hy4 preview na API?

O modelo custa US$ 0,834 por milhão de tokens de entrada e US$ 2,501 por milhão de tokens de saída, segundo os preços listados no OpenRouter.

Qual é a janela de contexto do Tencent Hy4 preview?

A janela é de 1.048.576 tokens, equivalente a 1 milhão de tokens em termos comerciais. Isso permite trabalhar com documentos extensos em uma única requisição, mas não garante qualidade superior.

O Tencent Hy4 preview já tem nota de inteligência ou código?

Não nos dados disponíveis do Artificial Analysis. O modelo aparece sem notas de inteligência, programação ou desempenho agêntico, e também sem estreia registrada em benchmark.

Leia também