FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Ring-2.6-1T: 1 trilhão de parâmetros por US$ 0,62 de saída

Modelo chinês open-weights da inclusionAI estreia com 63B ativos e mira agentes de código — mas fica abaixo do pelotão intermediário em inteligência geral.

Redação FalaVIP IA 3 min de leitura
US$ 0,625por milhão de tokens de saída
63B ativosde 1T parâmetros totais (MoE)
31,66índice de inteligência geral

A conta que o release não mostra

A inclusionAI abriu o catálogo hoje com o Ring-2.6-1T, um modelo de 1 trilhão de parâmetros totais — mas só 63 bilhões ativos por token, graças à arquitetura Mixture-of-Experts. É a mesma estratégia que a Xiaomi vem usando na linha MiMo: encher o tanque de conhecimento sem inflar o custo de inferência. A pergunta de quem paga a API não é se o número de parâmetros impressiona; é se o índice de inteligência de 31,66 justifica trocar o que já roda em produção.

Onde ele se encaixa no tabuleiro

O topo do catálogo hoje é o Gemini 3.1 Pro Preview, com 47,74 de IQ e US$ 12 por milhão de tokens de saída. Logo abaixo vêm GPT-5.3-Codex (45,51 / US$ 14) e DeepSeek V4 Pro (45,27 / US$ 1,74). O Ring entra com 31,66 — ou seja, fica entre 14 e 16 pontos atrás dos três primeiros e não disputa o topo. Entre os pares diretos, ele só passa do Gemma 4 26B A4B (26,07) e empata em faixa com o MiMo-V2-Flash (34,02), que cobra US$ 0,30 de saída.

Índice de inteligência (Artificial Analysis)
Ring-2.6-1T31,7MiMo-V2-Flash34Gemma 4 31B29,7Gemma 4 26B A4B 26,1MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

A leitura honesta: não é um flagship, é um cavalo de batalha para workloads específicos.

Onde ele brilha — e onde não

O Ring-2.6-1T é descrito como "thinking model" otimizado para agentes de código e tool use. A nota de coding é 42,83 — acima do IQ geral, o que confirma o foco. Mas o agentic score é só 20,10, um sinal de que ele raciocina sobre código sem necessariamente orquestrar bem ferramentas em cadeia. Para quem monta agente que só escreve função, é competitivo. Para agente multi-etapa com decisão sobre qual ferramenta chamar, o MiMo-V2-Flash ou o Gemma 4 31B (43,43 em coding, 14,38 em agentic) entregam perfis mais equilibrados.

Ficha técnica — Ring-2.6-1T
CampoValor
Identificadorinclusionai/ring-2.6-1t
Criadorinclusionai
Preço de entradaUS$ 0.075 / M tokens
Preço de saídaUS$ 0.625 / M tokens
Janela de contexto262k
Modalidadetext->text
Leitura de cacheUS$ 0.015 / M (80% de desconto)
Índice de inteligência (AA)31.7
Índice de código42.8
Índice agêntico20.1
Parâmetros1000B (63B ativos por token)
Pesosabertos
Velocidade de saída128 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

A velocidade reportada é 128,34 tokens por segundo — bem à frente dos 35,06 do Gemma 4 31B. Isso importa quando o agente fica em loop chamando o modelo dezenas de vezes por tarefa.

Preço: o argumento mais honesto

Entrada US$ 0,075 por milhão de tokens. Saída US$ 0,625. Cache de leitura US$ 0,015 — o mais barato entre os pares listados. Em workload típico de agente (80% entrada, 20% saída), o custo blended fica em torno de US$ 0,19 por milhão de tokens processados. É mais barato que o MiMo-V2-Flash (US$ 0,14 de entrada, US$ 0,30 de saída) na maioria dos cenários com muito prompt cacheado.

Preço de saída (US$ por milhão de tokens)
Ring-2.6-1T0,625MiMo-V2-Flash0,3Gemma 4 31B0,34Gemma 4 26B A4B 0,34MiMo-V2-Omni2US$/M
Fonte: OpenRouter

O detalhe que o release esconde: cache de leitura existe, mas só vale se você repetir o mesmo prefixo. Em agente que muda contexto a cada chamada, esse número é teórico.

Inteligência × preço de saída
Ring-2.6-1TMiMo-V2-FlashGemma 4 31BGemma 4 26B A4B MiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência

Para quem vale — e para quem não

Vale se você roda agente de código em volume, pode hospedar pesos abertos (1T total é pesado, mas só 63B ativos por inferência) e quer pagar menos que Xiaomi ou Google sem abrir mão de raciocínio. Não vale se você precisa de multimodal — o Ring é text-to-text puro, enquanto MiMo-V2-Omni aceita imagem, vídeo e áudio. Não vale se o gargalo é qualidade bruta de resposta: para isso, DeepSeek V4 Pro cobra US$ 1,74 e entrega IQ 45,27.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Ring-2.6-1T (o novo)31.70.0750.625262k
MiMo-V2-Flash34.00.10.3262k
Gemma 4 31B29.70.090.34262k
Gemma 4 26B A4B 26.10.070.34262k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O que fazer com isso hoje

Se seu agente hoje roda em Gemma 4 31B ou MiMo-V2-Flash, teste o Ring-2.6-1T na mesma suite — o ganho de velocidade pode compensar a diferença de IQ em tarefas curtas. Se roda em DeepSeek V4 Pro ou acima, não há motivo para trocar. E antes de colocar em produção, lembre: open weights significa que você pode hospedar, mas 1 trilhão de parâmetros exige infraestrutura que não cabe no seu MacBook.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 441 modelos disponíveis no catálogo nesta data.
Em uma frase

Rode o Ring-2.6-1T em agente de código com muito cache de prompt e veja se a velocidade de 128 t/s compensa o IQ 31,66 — para tudo o mais, o DeepSeek V4 Pro continua sendo a referência na faixa intermediária.

Perguntas frequentes

O Ring-2.6-1T é melhor que o DeepSeek V4 Pro?

Não em inteligência geral: o DeepSeek marca 45,27 contra 31,66 do Ring. O Ring só compete em preço e velocidade quando o workload é predominantemente agente de código com cache de leitura pesado.

Posso rodar o Ring-2.6-1T localmente?

Os pesos são abertos, mas 1 trilhão de parâmetros totais exige cluster de GPUs com VRAM alta ou inferência distribuída. Na prática, só 63B ficam ativos por token, o que reduz o custo real de inferência em hospedagem dedicada.

Quanto custa rodar um agente simples no Ring-2.6-1T?

Com 80% de entrada e 20% de saída, o custo blended fica em torno de US$ 0,19 por milhão de tokens. Em workload com cache de leitura ativo, cai mais — desde que o prefixo se repete entre chamadas.

Leia também