FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Tencent cobra US$ 0,60 por milhão de saída no Hy3 preview — 20 vezes mais barato que GPT-5.3-Codex

Novo modelo MoE da Tencent mira workflows agênticos e chega com versão gratuita, mas estreia sem nota de inteligência pública.

Redação FalaVIP IA 3 min de leitura
US$ 0,60por milhão de tokens de saída no Hy3 preview
US$ 0,18por milhão de tokens de entrada
US$ 0,06por milhão de tokens em cache

A conta de API não mente: enquanto a OpenAI cobra US$ 14 por milhão de tokens de saída no GPT-5.3-Codex e o Gemini 3.1 Pro Preview sai por US$ 12, a Tencent colocou o Hy3 preview na prateleira a US$ 0,60. Isso é cerca de 23 vezes menos que o modelo da OpenAI e 20 vezes menos que o do Google. A diferença não é marginal — é o tipo deEconomy;distância que muda a conta no fim do mês.

O que a Tencent jogou na mesa

O Hy3 preview é um Mixture-of-Experts focado em fluxos agênticos e uso em produção. A própria descrição oficial destaca algo raro: modos de raciocínio configuráveis — desligado, baixo e alto. Em vez de vender um único perfil de pensamento, o cliente paga para escolher quanto quer que o modelo "pense" antes de responder. A janela de contexto é de 262 mil tokens, suficiente para codebase médio com folga.

Ficha técnica — MiMo-V2.5-Pro
CampoValor
Identificadorxiaomi/mimo-v2.5-pro
Criadorxiaomi
Preço de entradaUS$ 0.435 / M tokens
Preço de saídaUS$ 0.870 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.004 / M (99% de desconto)
Índice de inteligência (AA)42.9
Índice de código60.2
Índice agêntico29.5
Parâmetros1023B (42B ativos por token)
Pesosabertos
Velocidade de saída34 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

A estratégia é dupla: uma versão paga a US$ 0,18 por milhão de entrada e US$ 0,60 por milhão de saída, e uma versão gratuita com o mesmo contexto de 262k tokens. Quem está testando agente não precisa colocar cartão para experimentar.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
MiMo-V2.50.140.281.05M

O que não está no release

O ponto que merece atenção é o que está ausente. A página do modelo no catálogo não traz índice de inteligência, nota de coding, agentic score, blended, nem contagem de parâmetros. Para um lançamento de empresa grande chinesa entrando num mercado competitivo, a opacidade nos números é barulhenta. A régua atual — medida pela Artificial Analysis hoje — tem Google Gemini 3.1 Pro Preview no topo, com IQ 47,7, e OpenAI GPT-5.3-Codex logo atrás com 45,5.

Índice de inteligência (Artificial Analysis)
MiMo-V2.5-Pro42,9Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2.538índice
Fonte: Artificial Analysis

Enquanto isso, a Xiaomi emplacou três modelos no top 5 recente: MiMo-V2.5-Pro (IQ 42,9), MiMo-V2.5 (38,0) e MiMo-V2-Omni (35,9). O cenário chinês está apertando por baixo, com preços de saída na faixa de US$ 0,28 a US$ 2 por milhão — bem mais agressivos que o bloco americano.

Para quem o Hy3 preview vale a pena

Se você roda agente em produção e gasta volume sério de tokens de saída — geração de código longo, tool calling pesado, chains que vomitam texto —, a conta fala. Um workload que custa US$ 1.000/mês no GPT-5.3-Codex cabe em algo perto de US$ 43 no Hy3 preview, na mesma régua de preço. Mesmo que a inteligência fique alguns pontos abaixo dos líderes, para tarefas de orquestração e execução a diferença pode ser aceitável.

Não muda nada para quem precisa do melhor reasoning bruto da categoria. Sem nota pública, comparar com Gemini 3.1 Pro Preview ou GPT-5.3-Codex no IQ é chute. E quem já tem contrato enterprise com OpenAI ou Google não troca por causa de preço de tabela — troca por SLA, suporte e estabilidade.

Preço de saída (US$ por milhão de tokens)
MiMo-V2.5-Pro0,87Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2.50,28US$/M
Fonte: OpenRouter

Como se compara

Olhando preço de saída puro, o Hy3 preview entra mais barato que todos os modelos do topo que têm nota acima de 45 de IQ. A régua "acima de IQ 45" hoje só tem dois inquilinos, e ambos cobram entre 12 e 14 dólares.

Inteligência × preço de saída
MiMo-V2.5-ProGemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2.5US$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
MiMo-V2.5-Pro (o novo)42.90.4350.871.05M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2.538.00.140.281.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A linha completa do dia mostra 30 modelos lançados nos últimos 30 dias num catálogo de 404 opções mantidas por 56 criadores. Não é estreia tímida — é mais um capítulo da guerra de preços chinesa invadindo o terreno americano.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
MiMo-V2-Omni35.92
Entre os 404 modelos disponíveis no catálogo nesta data.

O que fazer com isso hoje

Se o seu gargalo é custo de saída em agente, faça um piloto com a versão gratuita primeiro. Meça taxa de sucesso de tool calls, latência e qualidade de output no seu caso real. Se o resultado estiver num intervalo aceitável, a economia de 90% sobre o tier topo paga o risco do modelo novo. Não faça deploy crítico sem benchmark próprio.

Em uma frase

Rode um piloto gratuito no Hy3 preview hoje se o seu gargalo é custo de saída em agente; se a taxa de sucesso se mantiver, a economia de 90% sobre o GPT-5.3-Codex e o Gemini 3.1 Pro Preview paga o risco de adotar um modelo sem benchmark público.

Perguntas frequentes

Quanto custa o Hy3 preview da Tencent?

US$ 0,18 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. Tokens em cache saem por US$ 0,06 por milhão. Existe versão gratuita com o mesmo contexto de 262 mil tokens.

O Hy3 preview tem nota de inteligência?

Não. No momento do lançamento, o catálogo não publicou IQ, nota de coding nem agentic score. A comparação com Gemini 3.1 Pro Preview (IQ 47,7) e GPT-5.3-Codex (IQ 45,5) fica sem régua direta até sair medição independente.

O Hy3 preview serve para que tipo de tarefa?

Workflows agênticos e uso em produção, segundo a descrição oficial, com três modos de raciocínio configuráveis (desligado, baixo, alto) e janela de contexto de 262 mil tokens — útil para tool calling pesado, geração de código longa e chains que produzem muito texto de saída.

Leia também