Tongyi DeepResearch 30B A3B: 3B ativos por US$ 0,45/milhão
Lançado hoje pela Tongyi Lab, o modelo agentic estreia sem nota de inteligência publicada e aposta em pesquisa longa a preço de commodity.
O preço chegou antes da nota
Você olha o catálogo, vê um modelo novo da Tongyi Lab listado nesta quinta-feira e a primeira pergunta não é "o que ele faz" — é "quanto custa e onde está o IQ". A resposta para a segunda metade: não está. O Tongyi DeepResearch 30B A3B estreia sem nota de inteligência publicada, sem benchmark de código e sem score agentic no catálogo. Em outras palavras, o fornecedor abriu a porta sem pendurar o quadro na parede.
O que está pendurado é a tabela de preços, e ela é agressiva. Entrada e cache custam US$ 0,09 por milhão de tokens; saída, US$ 0,45. Para efeito de comparação, o OpenAI o3 — que lidera o ranking de inteligência do dia — sai por US$ 8 por milhão de tokens. Estamos falando de quase 18 vezes mais barato no token de saída, sem que se saiba ainda qual é o custo real em qualidade.
O que significa "30B com 3B ativos"
A arquitetura é MoE: 30 bilhões de parâmetros totais, mas só 3 bilhões são ativados por token. Pense num restaurante com cardápio enorme e só três cozinheiros de plantão — a despensa é grande, mas quem efetivamente prepara o prato é uma fração. Isso explica o preço baixo de inferência: o que roda de verdade por token é leve, mesmo que o modelo "total" pareça pesado no papel.
A descrição oficial diz que o modelo foi otimizado para tarefas agentic de horizonte longo, do tipo "pesquise, leia, planeje, reescreva". Contexto de 131 mil tokens, corte de conhecimento em março de 2025. É um perfil de uso bem específico: não é o modelo que você chama para bate-papo, é o que você coloca para virar a noite lendo relatórios.
| Campo | Valor |
|---|---|
| Identificador | alibaba/tongyi-deepresearch-30b-a3b |
| Criador | alibaba |
| Preço de entrada | US$ 0.090 / M tokens |
| Preço de saída | US$ 0.450 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.090 / M (0% de desconto) |
Onde ele entra no tabuleiro
O catálogo desta data tem 229 modelos listados, vindos de 39 criadores, com 15 lançamentos nos últimos 30 dias. O topo de inteligência segue dominado pela OpenAI: o3 na frente com IQ 31,1, seguido do gpt-oss-120b com 24,1 e do Qwen3 Next 80B A3B Thinking com 16,9. O Tongyi DeepResearch não aparece nesse ranking — e, repito, não porque ficou de fora por nota ruim, mas porque a nota simplesmente não foi publicada.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Vale notar quem é o pai: Alibaba, via Tongyi Lab. O Qwen3 Next 80B A3B Thinking, que está no top 3 de inteligência e sai por US$ 1,20 por milhão de tokens de saída, vem da mesma casa. Ou seja, a Alibaba já tem um modelo caro e bem colocado; o Tongyi DeepResearch é a aposta barata e vertical em pesquisa profunda.
Para quem vale — e para quem não muda nada
Se você roda fluxos agentic que consomem muito contexto e emitem relativamente pouco — sumarizar dezenas de PDFs, navegar e sintetizar, fazer varredura de código em repositório grande — o custo por execução cai drasticamente nesse preço de US$ 0,45 de saída. Para um trabalho de 100 mil tokens de saída, a conta fica em US$ 0,045; no o3, seria US$ 0,80. Em volume, isso muda a economia do produto.
Se, por outro lado, você precisa de nota de IQ auditada para vender o modelo para o cliente, ou se o seu caso de uso é raciocínio curto e respostas curtas, este não é o lugar. Sem benchmark público, você está comprando no escuro — e a economia só se realiza se a qualidade agentic for compatível com a sua tarefa. O caminho sensato é testar com um conjunto representativo antes de migrar produção.
O que fazer com isso hoje
Trate o Tongyi DeepResearch 30B A3B como uma opção de custo para workloads agentic de horizonte longo, não como substituto do modelo principal. Mantenha o o3 ou o Qwen3 Thinking para o que exige raciocínio pesado; use o Tongyi para o que exige muitas chamadas e muito contexto. E espere a nota de inteligência aparecer — quando vier, ela vai dizer se os 18x de economia no token de saída eram reais ou só marketing.
Para fluxos agentic que queimam muito contexto e pouca saída, vale testar como camada de custo; para tudo que precisa de nota auditada, espere o benchmark.
Perguntas frequentes
Quanto custa o Tongyi DeepResearch 30B A3B?
US$ 0,09 por milhão de tokens de entrada e cache, e US$ 0,45 por milhão de tokens de saída. Não há camada gratuita publicada no catálogo.
O Tongyi DeepResearch tem nota de inteligência?
Não. No catálogo desta data, os campos de IQ, coding e agentic estão vazios para o modelo — o que significa que o criador ainda não publicou benchmark padronizado.
Quem é o criador e de onde vem?
Tongyi Lab, ligado à Alibaba. É da mesma casa do Qwen3 Next 80B A3B Thinking, que está entre os três mais inteligentes do catálogo.