Tencent cobra US$ 0,60 por milhão de saída no Hy3 preview — 20 vezes mais barato que GPT-5.3-Codex
Novo modelo MoE da Tencent mira workflows agênticos e chega com versão gratuita, mas estreia sem nota de inteligência pública.
A conta de API não mente: enquanto a OpenAI cobra US$ 14 por milhão de tokens de saída no GPT-5.3-Codex e o Gemini 3.1 Pro Preview sai por US$ 12, a Tencent colocou o Hy3 preview na prateleira a US$ 0,60. Isso é cerca de 23 vezes menos que o modelo da OpenAI e 20 vezes menos que o do Google. A diferença não é marginal — é o tipo deEconomy;distância que muda a conta no fim do mês.
O que a Tencent jogou na mesa
O Hy3 preview é um Mixture-of-Experts focado em fluxos agênticos e uso em produção. A própria descrição oficial destaca algo raro: modos de raciocínio configuráveis — desligado, baixo e alto. Em vez de vender um único perfil de pensamento, o cliente paga para escolher quanto quer que o modelo "pense" antes de responder. A janela de contexto é de 262 mil tokens, suficiente para codebase médio com folga.
| Campo | Valor |
|---|---|
| Identificador | xiaomi/mimo-v2.5-pro |
| Criador | xiaomi |
| Preço de entrada | US$ 0.435 / M tokens |
| Preço de saída | US$ 0.870 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.004 / M (99% de desconto) |
| Índice de inteligência (AA) | 42.9 |
| Índice de código | 60.2 |
| Índice agêntico | 29.5 |
| Parâmetros | 1023B (42B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 34 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
A estratégia é dupla: uma versão paga a US$ 0,18 por milhão de entrada e US$ 0,60 por milhão de saída, e uma versão gratuita com o mesmo contexto de 262k tokens. Quem está testando agente não precisa colocar cartão para experimentar.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| MiMo-V2.5 | 0.14 | 0.28 | 1.05M |
O que não está no release
O ponto que merece atenção é o que está ausente. A página do modelo no catálogo não traz índice de inteligência, nota de coding, agentic score, blended, nem contagem de parâmetros. Para um lançamento de empresa grande chinesa entrando num mercado competitivo, a opacidade nos números é barulhenta. A régua atual — medida pela Artificial Analysis hoje — tem Google Gemini 3.1 Pro Preview no topo, com IQ 47,7, e OpenAI GPT-5.3-Codex logo atrás com 45,5.
Enquanto isso, a Xiaomi emplacou três modelos no top 5 recente: MiMo-V2.5-Pro (IQ 42,9), MiMo-V2.5 (38,0) e MiMo-V2-Omni (35,9). O cenário chinês está apertando por baixo, com preços de saída na faixa de US$ 0,28 a US$ 2 por milhão — bem mais agressivos que o bloco americano.
Para quem o Hy3 preview vale a pena
Se você roda agente em produção e gasta volume sério de tokens de saída — geração de código longo, tool calling pesado, chains que vomitam texto —, a conta fala. Um workload que custa US$ 1.000/mês no GPT-5.3-Codex cabe em algo perto de US$ 43 no Hy3 preview, na mesma régua de preço. Mesmo que a inteligência fique alguns pontos abaixo dos líderes, para tarefas de orquestração e execução a diferença pode ser aceitável.
Não muda nada para quem precisa do melhor reasoning bruto da categoria. Sem nota pública, comparar com Gemini 3.1 Pro Preview ou GPT-5.3-Codex no IQ é chute. E quem já tem contrato enterprise com OpenAI ou Google não troca por causa de preço de tabela — troca por SLA, suporte e estabilidade.
Como se compara
Olhando preço de saída puro, o Hy3 preview entra mais barato que todos os modelos do topo que têm nota acima de 45 de IQ. A régua "acima de IQ 45" hoje só tem dois inquilinos, e ambos cobram entre 12 e 14 dólares.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| MiMo-V2.5-Pro (o novo) | 42.9 | 0.435 | 0.87 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2.5 | 38.0 | 0.14 | 0.28 | 1.05M |
A linha completa do dia mostra 30 modelos lançados nos últimos 30 dias num catálogo de 404 opções mantidas por 56 criadores. Não é estreia tímida — é mais um capítulo da guerra de preços chinesa invadindo o terreno americano.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
| MiMo-V2-Omni | 35.9 | 2 |
O que fazer com isso hoje
Se o seu gargalo é custo de saída em agente, faça um piloto com a versão gratuita primeiro. Meça taxa de sucesso de tool calls, latência e qualidade de output no seu caso real. Se o resultado estiver num intervalo aceitável, a economia de 90% sobre o tier topo paga o risco do modelo novo. Não faça deploy crítico sem benchmark próprio.
Rode um piloto gratuito no Hy3 preview hoje se o seu gargalo é custo de saída em agente; se a taxa de sucesso se mantiver, a economia de 90% sobre o GPT-5.3-Codex e o Gemini 3.1 Pro Preview paga o risco de adotar um modelo sem benchmark público.
Perguntas frequentes
Quanto custa o Hy3 preview da Tencent?
US$ 0,18 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. Tokens em cache saem por US$ 0,06 por milhão. Existe versão gratuita com o mesmo contexto de 262 mil tokens.
O Hy3 preview tem nota de inteligência?
Não. No momento do lançamento, o catálogo não publicou IQ, nota de coding nem agentic score. A comparação com Gemini 3.1 Pro Preview (IQ 47,7) e GPT-5.3-Codex (IQ 45,5) fica sem régua direta até sair medição independente.
O Hy3 preview serve para que tipo de tarefa?
Workflows agênticos e uso em produção, segundo a descrição oficial, com três modos de raciocínio configuráveis (desligado, baixo, alto) e janela de contexto de 262 mil tokens — útil para tool calling pesado, geração de código longa e chains que produzem muito texto de saída.