Tongyi DeepResearch 30B A3B chega por US$ 0,45 por milhão de tokens de saída
Modelo agentic da Alibaba com 30B de parâmetros totais e 3B ativos mira tarefas longas de pesquisa — e cobra menos que o o3-mini, mas sem nota de inteligência medida
A conta de API tem uma nova opção barata para quem roda agente de pesquisa longa, e o catálogo não publicou índice de inteligência para ela. O Tongyi DeepResearch 30B A3B, da Tongyi Lab (braço da Alibaba), apareceu hoje no catálogo com preço de saída de US$ 0,45 por milhão de tokens — entrada a US$ 0,09 e cache de leitura no mesmo valor. É um modelo text-to-text, com 131 mil tokens de contexto e knowledge cutoff em março de 2025.
O que é o "30B A3B"
A notação é honesta: são 30 bilhões de parâmetros totais, mas só 3 bilhões são ativados por token. É a mesma arquitetura Mixture-of-Experts que o Qwen3 Next 80B A3B Thinking já usa — só que menor. A descrição oficial diz que o modelo é otimizado para "long-horizon, deep information-seeking tasks": pense em agente que navega, lê, planeja e volta atrás durante muitos passos antes de te dar uma resposta.
A analogia do dia: é como um carro híbrido. O motor inteiro pesa 30B, mas você só paga combustível (computação) pelos 3B que estão rodando agora. Daí o preço.
Preço comparado ao que já estava na prateleira
Olhando só o custo de saída, o Tongyi DeepResearch entra mais barato que o Qwen3 Next 80B A3B Thinking (US$ 1,20/M), mas mais caro que o gpt-oss-120b da OpenAI (US$ 0,17/M). Frente ao o3, que lidera o índice de inteligência do catálogo, a diferença é brutal: o3 cobra US$ 8 por milhão de tokens de saída — quase 18 vezes mais.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Tongyi DeepResearch 30B A3B (o novo) | — | 0.09 | 0.45 | 131k |
| o3 | 31.1 | 2 | 8 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Qwen3 Next 80B A3B Thinking | 16.9 | 0.15 | 1.2 | 262k |
Mas preço sem nota de inteligência é meio da conta. O catálogo não publicou IQ, coding, agentic nem blended para esse modelo — então não dá para colocar lado a lado no gráfico de custo-benefício com os outros.
Onde ele se encaixa no tabuleiro
O topo do catálogo hoje, medido pelo índice de inteligência, segue dominado pela OpenAI: o3 em primeiro (IQ 31,096), gpt-oss-120b em segundo (24,126) e gpt-oss-20b em quarto (15,225). O Qwen3 Next 80B A3B Thinking aparece em terceiro (16,867). O Tongyi DeepResearch entra sem nota — você está comprando no escuro quanto a qualidade bruta, mas pagando caro barato.
A origem é chinesa (Alibaba/Tongyi Lab), o que o coloca na mesma família de rivais do Qwen3. O catálogo tem 229 modelos listados hoje, de 39 criadores, e 15 lançamentos nos últimos 30 dias — o ritmo de novidades continua alto.
Para quem vale
Vale se você está montando pipeline agentic de pesquisa longa e precisa manter o custo por requisição baixo — o preço de cache igual ao de entrada (US$ 0,09) é um sinal de que o modelo foi pensado para fluxos com muita leitura repetida. Para quem roda agente que precisa de raciocínio pesado e mede qualidade por benchmark, o o3 continua sendo a referência — e custa bem mais.
Para quem não muda nada
Se você já está no gpt-oss-120b por causa do preço agressivo de US$ 0,17/M de saída, o Tongyi DeepResearch não traz argumento de custo. Se você precisa de nota de inteligência publicada para comparar antes de adotar, esse modelo simplesmente não te dá essa régua hoje — o catálogo não mediu.
| Campo | Valor |
|---|---|
| Identificador | alibaba/tongyi-deepresearch-30b-a3b |
| Criador | alibaba |
| Preço de entrada | US$ 0.090 / M tokens |
| Preço de saída | US$ 0.450 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.090 / M (0% de desconto) |
A implicação prática: trate como mais uma opção na fila de modelos agentic baratos, peça um piloto curto antes de migrar carga, e não confie só no preço — sem benchmark público, você está pagando para descobrir a qualidade.
Adote como opção barata para agente de pesquisa longa, mas rode um piloto antes de migrar carga — sem IQ publicado, o preço baixo é metade da informação que você precisa.
Perguntas frequentes
Quanto custa o Tongyi DeepResearch 30B A3B?
US$ 0,09 por milhão de tokens de entrada, US$ 0,45 por milhão de tokens de saída, e cache de leitura também a US$ 0,09. É mais barato que o o3, mas mais caro que o gpt-oss-120b.
O Tongyi DeepResearch tem benchmark de inteligência publicado?
Não. O catálogo não publicou índice de inteligência, coding, agentic nem blended para esse modelo — então não dá para comparar diretamente com o3 ou Qwen3 por nota.
Para que tipo de tarefa o Tongyi DeepResearch foi feito?
A descrição oficial aponta para tarefas agentic de pesquisa longa: navegação, leitura, planejamento em múltiplos passos antes de devolver a resposta. Tem 131 mil tokens de contexto.