InclusionAI solta modelo de 1 trilhão de parâmetros por US$ 0,62 por milhão de saída
Ring-2.6-1T chega com 63B ativos, foco em agentes e preço de balcão — mas fica bem abaixo do topo em inteligência.
O que está no balcão hoje
A InclusionAI jogou nesta quinta um pacote inteiro no catálogo: o Ring-2.6-1T como carro-chefe e a versão :free do mesmo modelo, sem custo de API. O destaque da ficha é o contraste entre o tamanho declarado — 1 trilhão de parâmetros totais, com 63 bilhões ativos por passagem — e o preço de saída: US$ 0,625 por milhão de tokens. É a conta que importa, e ela é agressiva.
Pense no 1T/63B como um motor de caminhão ligado só em parte do tempo: você leva o peso do caminhão no nome, mas só paga o combustível do motor menor. É a arquitetura Mixture-of-Experts aplicada com força total — e é exatamente o que a DeepSeek fez barulho com o V4 Pro.
O que o modelo entrega (e o que não entrega)
O Ring-2.6-1T é descrito pelo próprio criador como um "thinking model" voltado para agentes — fluxos de codificação, uso de ferramentas e automação real. A ficha registra 262 mil tokens de contexto, modalidade texto→texto, raciocínio ativado e pesos abertos. A velocidade medida fica em 128 tokens por segundo, número saudável para a categoria.
Onde o marketing encontra o chão: o índice de inteligência Artificial Analysis marca 31,66. Em coding, sobe para 42,83; em agentic, despenca para 20,10. É um perfil de especialista, não de generalista.
| Campo | Valor |
|---|---|
| Identificador | inclusionai/ring-2.6-1t |
| Criador | inclusionai |
| Preço de entrada | US$ 0.075 / M tokens |
| Preço de saída | US$ 0.625 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.015 / M (80% de desconto) |
| Índice de inteligência (AA) | 31.7 |
| Índice de código | 42.8 |
| Índice agêntico | 20.1 |
| Parâmetros | 1000B (63B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 128 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
A conta contra os rivais
Coloque o Ring-2.6-1T na mesa com quem já estava sentado e a história fica clara.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Ring-2.6-1T (o novo) | 31.7 | 0.075 | 0.625 | 262k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
O DeepSeek V4 Pro cobra US$ 1,74 por milhão de saída e marca 45,27 de inteligência. O Gemini 3.1 Pro Preview custa US$ 12 e marca 47,74. O GPT-5.3-Codex cobra US$ 14 e marca 45,51. O Ring-2.6-1T cobra US$ 0,625 e marca 31,66.
Traduzindo: você paga entre 2,8 e 22 vezes menos por milhão de saída do que esses três — e entrega, em intelligence bruto, 70% do DeepSeek V4 Pro, 66% do Gemini 3.1 Pro Preview e 70% do GPT-5.3-Codex.
Para quem está rodando agente de código em loop, com milhares de chamadas por dia, essa diferença de tarifa pode ser o que define se o projeto cabe no orçamento do mês. Para quem precisa do teto de capacidade em raciocínio geral, não muda nada — o Ring-2.6-1T não está nessa briga.
A família do dia
A InclusionAI não soltou só o modelo pago. A versão :free aparece com tarifa zero de entrada e zero de saída, mesmo contexto de 262 mil tokens. É a porta de entrada para testar sem colocar cartão.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Ring-2.6-1T (free) | 0 | 0 | 262k |
Onde isso encaixa no tabuleiro
O catálogo hoje soma 441 modelos de 60 criadores, com 51 lançamentos nos últimos 30 dias. O topo de inteligência segue com Gemini 3.1 Pro Preview (47,74), GPT-5.3-Codex (45,51) e DeepSeek V4 Pro (45,27). Xiaomi aparece em quarto e quinto com o MiMo-V2.5-Pro e o MiMo-V2.5.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
O Ring-2.6-1T entra abaixo desse bloco, na faixa dos 30 pontos de intelligence. É um especialista de baixo custo vindo da China, com pesos abertos, brigando por volume — não por troféu.
Para quem vale, para quem não vale
Vale para você se roda agentes de código em escala, tem a fatura da API como inimigo mensal e aceita trocar capacidade bruta por custo por chamada. A versão :free é um bom campo de prova antes de comprometer orçamento.
Não muda nada para você se precisa do teto de raciocínio para tarefas abertas, pesquisa, ou benchmarks de fronteira. O Gemini 3.1 Pro Preview e o GPT-5.3-Codex continuam lá em cima, e o DeepSeek V4 Pro segue sendo o melhor negócio entre os modelos acima de 45 de intelligence — custando quase três vezes o Ring, mas entregando 43% mais capability bruta.
A implicação prática é direta: se seu agente gasta milhões de tokens por dia, faça um teste A/B entre Ring-2.6-1T e DeepSeek V4 Pro no mesmo workload. A diferença de tarifa é grande o suficiente para mudar a conta no fim do mês — e a diferença de capability é grande o suficiente para você não descobrir no piloto.
Se seu gargalo é custo por chamada em agente de código, teste o Ring-2.6-1T hoje; se é capacidade máxima de raciocínio, o DeepSeek V4 Pro segue sendo o melhor custo-benefício acima de 45 de intelligence.
Perguntas frequentes
Quanto custa o Ring-2.6-1T da InclusionAI?
US$ 0,075 por milhão de tokens de entrada e US$ 0,625 por milhão de tokens de saída, com cache a US$ 0,015 por milhão. Existe também a versão `:free`, com tarifa zero de entrada e saída.
O Ring-2.6-1T é melhor que o DeepSeek V4 Pro?
Não em intelligence bruto: o DeepSeek V4 Pro marca 45,27 contra 31,66 do Ring. O Ring cobra menos de metade por milhão de saída (US$ 0,625 contra US$ 1,74), então a escolha depende de quanto você valoriza capacidade por chamada versus custo total.
O Ring-2.6-1T tem pesos abertos?
Sim. A ficha registra open_weights como true, com 1 trilhão de parâmetros totais e 63 bilhões ativos por inferência.