FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Tongyi DeepResearch 30B A3B chega por US$ 0,45 por milhão de tokens de saída

Modelo agentic da Alibaba com 30B de parâmetros totais e 3B ativos mira tarefas longas de pesquisa — e cobra menos que o o3-mini, mas sem nota de inteligência medida

Redação FalaVIP IA 3 min de leitura
US$ 0,45por milhão de tokens de saída
30B / 3Bparâmetros totais vs. ativos por token
131.072tokens de contexto

A conta de API tem uma nova opção barata para quem roda agente de pesquisa longa, e o catálogo não publicou índice de inteligência para ela. O Tongyi DeepResearch 30B A3B, da Tongyi Lab (braço da Alibaba), apareceu hoje no catálogo com preço de saída de US$ 0,45 por milhão de tokens — entrada a US$ 0,09 e cache de leitura no mesmo valor. É um modelo text-to-text, com 131 mil tokens de contexto e knowledge cutoff em março de 2025.

O que é o "30B A3B"

A notação é honesta: são 30 bilhões de parâmetros totais, mas só 3 bilhões são ativados por token. É a mesma arquitetura Mixture-of-Experts que o Qwen3 Next 80B A3B Thinking já usa — só que menor. A descrição oficial diz que o modelo é otimizado para "long-horizon, deep information-seeking tasks": pense em agente que navega, lê, planeja e volta atrás durante muitos passos antes de te dar uma resposta.

A analogia do dia: é como um carro híbrido. O motor inteiro pesa 30B, mas você só paga combustível (computação) pelos 3B que estão rodando agora. Daí o preço.

Preço comparado ao que já estava na prateleira

Preço de saída (US$ por milhão de tokens)
Tongyi DeepResearch 30B A3B0,45o38gpt-oss-120b0,17Qwen3 Next 80B A3B Thinking1,2US$/M
Fonte: OpenRouter

Olhando só o custo de saída, o Tongyi DeepResearch entra mais barato que o Qwen3 Next 80B A3B Thinking (US$ 1,20/M), mas mais caro que o gpt-oss-120b da OpenAI (US$ 0,17/M). Frente ao o3, que lidera o índice de inteligência do catálogo, a diferença é brutal: o3 cobra US$ 8 por milhão de tokens de saída — quase 18 vezes mais.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Tongyi DeepResearch 30B A3B (o novo)0.090.45131k
o331.128200k
gpt-oss-120b24.10.0370.17131k
Qwen3 Next 80B A3B Thinking16.90.151.2262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Mas preço sem nota de inteligência é meio da conta. O catálogo não publicou IQ, coding, agentic nem blended para esse modelo — então não dá para colocar lado a lado no gráfico de custo-benefício com os outros.

Onde ele se encaixa no tabuleiro

Índice de inteligência (Artificial Analysis)
o331,1gpt-oss-120b24,1Qwen3 Next 80B A3B Thinking16,9índice
Fonte: Artificial Analysis

O topo do catálogo hoje, medido pelo índice de inteligência, segue dominado pela OpenAI: o3 em primeiro (IQ 31,096), gpt-oss-120b em segundo (24,126) e gpt-oss-20b em quarto (15,225). O Qwen3 Next 80B A3B Thinking aparece em terceiro (16,867). O Tongyi DeepResearch entra sem nota — você está comprando no escuro quanto a qualidade bruta, mas pagando caro barato.

A origem é chinesa (Alibaba/Tongyi Lab), o que o coloca na mesma família de rivais do Qwen3. O catálogo tem 229 modelos listados hoje, de 39 criadores, e 15 lançamentos nos últimos 30 dias — o ritmo de novidades continua alto.

Para quem vale

Vale se você está montando pipeline agentic de pesquisa longa e precisa manter o custo por requisição baixo — o preço de cache igual ao de entrada (US$ 0,09) é um sinal de que o modelo foi pensado para fluxos com muita leitura repetida. Para quem roda agente que precisa de raciocínio pesado e mede qualidade por benchmark, o o3 continua sendo a referência — e custa bem mais.

Para quem não muda nada

Se você já está no gpt-oss-120b por causa do preço agressivo de US$ 0,17/M de saída, o Tongyi DeepResearch não traz argumento de custo. Se você precisa de nota de inteligência publicada para comparar antes de adotar, esse modelo simplesmente não te dá essa régua hoje — o catálogo não mediu.

Ficha técnica — Tongyi DeepResearch 30B A3B
CampoValor
Identificadoralibaba/tongyi-deepresearch-30b-a3b
Criadoralibaba
Preço de entradaUS$ 0.090 / M tokens
Preço de saídaUS$ 0.450 / M tokens
Janela de contexto131k
Modalidadetext->text
Leitura de cacheUS$ 0.090 / M (0% de desconto)

A implicação prática: trate como mais uma opção na fila de modelos agentic baratos, peça um piloto curto antes de migrar carga, e não confie só no preço — sem benchmark público, você está pagando para descobrir a qualidade.

Em uma frase

Adote como opção barata para agente de pesquisa longa, mas rode um piloto antes de migrar carga — sem IQ publicado, o preço baixo é metade da informação que você precisa.

Perguntas frequentes

Quanto custa o Tongyi DeepResearch 30B A3B?

US$ 0,09 por milhão de tokens de entrada, US$ 0,45 por milhão de tokens de saída, e cache de leitura também a US$ 0,09. É mais barato que o o3, mas mais caro que o gpt-oss-120b.

O Tongyi DeepResearch tem benchmark de inteligência publicado?

Não. O catálogo não publicou índice de inteligência, coding, agentic nem blended para esse modelo — então não dá para comparar diretamente com o3 ou Qwen3 por nota.

Para que tipo de tarefa o Tongyi DeepResearch foi feito?

A descrição oficial aponta para tarefas agentic de pesquisa longa: navegação, leitura, planejamento em múltiplos passos antes de devolver a resposta. Tem 131 mil tokens de contexto.

Leia também