FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Arcee AI lança Trinity Large Thinking por US$ 0,80 por milhão de saída

Modelo de raciocínio aberto, com 399B de parâmetros e 13B ativos, mira custo baixo — mas fica bem abaixo do topo em inteligência.

Redação FalaVIP IA 3 min de leitura
US$ 0,80por milhão de tokens de saída
US$ 0,25por milhão de tokens de entrada
18,66índice de inteligência (Artificial Analysis)

O que a Arcee AI colocou na mesa hoje

A conta de API está mais uma vez no centro da notícia. A Arcee AI soltou nesta terça-feira (1º de abril) o Trinity Large Thinking, um modelo de raciocínio com pesos abertos, 399 bilhões de parâmetros totais e apenas 13 bilhões ativos por token — uma arquitetura MoE que, no fim do mês, pesa bem menos no seu bolso do que parece. O preço de saída é US$ 0,80 por milhão de tokens; o de entrada, US$ 0,25; com cache a US$ 0,06. Janela de contexto de 262 mil tokens.

Ficha técnica — Trinity Large Thinking
CampoValor
Identificadorarcee-ai/trinity-large-thinking
Criadorarcee-ai
Preço de entradaUS$ 0.250 / M tokens
Preço de saídaUS$ 0.800 / M tokens
Janela de contexto262k
Modalidadetext->text
Leitura de cacheUS$ 0.060 / M (76% de desconto)
Índice de inteligência (AA)18.7
Índice de código25.8
Índice agêntico3.7
Parâmetros399B (13B ativos por token)
Pesosabertos
Velocidade de saída311 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Em tradução direta: você paga menos de um centavo de dólar por cada mil tokens que o modelo devolve — desde que consiga encaixar o trabalho dele no seu pipeline.

Onde ele se perde

Olha o índice de inteligência e a conversa muda. O Trinity Large Thinking marca 18,66 no índice da Artificial Analysis — uma fração do que os dois modelos mais caros do catálogo entregam hoje: Google Gemini 3.1 Pro Preview (47,74) e OpenAI GPT-5.3-Codex (45,51). Em agentic, a nota é 3,72; em coding, 25,77. É um modelo que raciocina, mas não é um modelo que lidera.

Índice de inteligência (Artificial Analysis)
Trinity Large Thinking18,7Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

A Arcee destaca nos materiais que ele “mostra forte desempenho em PinchBench, agentic workloads e tarefas de raciocínio”. Traduzindo: o modelo foi treinado para pensar em voz alta e se sair bem em benchmarks específicos — não para destronar ninguém do topo.

O que ficou barato — e o que não

O marketing diz “modelo de raciocínio acessível”. O número confirma a parte do preço. Comparado com os dois únicos modelos acima de IQ 45 no catálogo atual, o Gemini Pro Preview (US$ 12 por milhão de saída) e o GPT-5.3-Codex (US$ 14), o Trinity sai por 15 vezes menos no token de saída. É uma diferença que aparece na fatura.

Preço de saída (US$ por milhão de tokens)
Trinity Large Thinking0,8Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

Mas o que não mudou: a distância em capacidade. No gráfico de custo-benefício, o Trinity ocupa um canto bem distinto dos dois líderes — barato, porém com índice de inteligência numa faixa à qual os topos nem chegam perto.

Inteligência × preço de saída
Trinity Large ThinkingGemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência

A linha completa da Arcee AI hoje

Junto com a versão paga, a empresa publicou uma variante gratuita do mesmo modelo, com a mesma janela de 262 mil tokens e custo zero de entrada e saída. É a oferta típica de “experimenta primeiro, paga depois” — útil pra quem quer validar o raciocínio antes de colocar em produção.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Trinity Large Thinking (free00262k

Pra quem vale — e pra quem não

Vale pra você se o seu gargalo é custo por token em tarefas de raciocínio que não exigem o estado da arte — sumarização de documentos longos, agentes internos com orçamento apertado, prototipagem rápida, geração de código de baixa criticidade. Os 262 mil tokens de contexto abrem espaço para workloads que outros modelos pequenos não acomodam.

Não muda nada pra você se a sua escolha de modelo gira em torno de benchmarks de coding de ponta, agentic complexo ou qualquer coisa que dependa de IQ acima de 40. Nesse terreno, Gemini Pro Preview e GPT-5.3-Codex continuam reinando, e o Xiaomi MiMo-V2-Omni (IQ 35,87, US$ 2 por milhão de saída) já oferece um meio-termo mais inteligente por um custo que ainda é baixo.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Trinity Large Thinking (o novo)18.70.250.8262k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O contexto do dia ajuda a calibrar: o catálogo soma hoje 382 modelos listados, de 54 criadores, com 32 lançamentos nos últimos 30 dias. O topo absoluto segue dominado por Google e OpenAI, e a faixa de modelos chineses (Xiaomi, Qwen) vem ocupando o espaço intermediário com preços agressivos. A Arcee entra por baixo — em preço — e em código aberto.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 382 modelos disponíveis no catálogo nesta data.

O que fazer com isso

Se você roda agentes em volume e a conta de API está incomodando, vale testar o Trinity Large Thinking como substituto de tarefas que hoje vão para modelos acima de IQ 40. Meça no seu caso real: o índice agregado não traduz automaticamente para o seu workload. E se a variável é “quero o melhor raciocínio que existe, dinheiro é secundário”, continue pagando Gemini Pro Preview — a diferença de US$ 11 por milhão de tokens tem um motivo.

Em uma frase

Rode o Trinity Large Thinking em workloads de raciocínio onde o custo pesa mais que o topo do benchmark — e meça no seu caso antes de migrar o que hoje vai para Gemini ou GPT.

Perguntas frequentes

Quanto custa o Arcee Trinity Large Thinking?

US$ 0,80 por milhão de tokens de saída e US$ 0,25 por milhão de tokens de entrada, com cache a US$ 0,06 por milhão. Existe também uma variante gratuita com a mesma janela de contexto.

O Trinity Large Thinking é melhor que o Gemini 3.1 Pro Preview?

Não. O índice de inteligência do Trinity é 18,66 contra 47,74 do Gemini Pro Preview. A vantagem do Trinity é o preço: sai por cerca de 15 vezes menos no token de saída.

O Arcee Trinity Large Thinking tem pesos abertos?

Sim. É um modelo open weights, com 399 bilhões de parâmetros totais e 13 bilhões ativos por inferência (arquitetura MoE).

Leia também