FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Tongyi DeepResearch 30B A3B: 3B ativos por US$ 0,45/milhão

Lançado hoje pela Tongyi Lab, o modelo agentic estreia sem nota de inteligência publicada e aposta em pesquisa longa a preço de commodity.

Redação FalaVIP IA 3 min de leitura
US$ 0,45por milhão de tokens de saída
US$ 0,09por milhão de tokens de entrada (e cache)
3 bilhõesparâmetros ativos em 30B totais

O preço chegou antes da nota

Você olha o catálogo, vê um modelo novo da Tongyi Lab listado nesta quinta-feira e a primeira pergunta não é "o que ele faz" — é "quanto custa e onde está o IQ". A resposta para a segunda metade: não está. O Tongyi DeepResearch 30B A3B estreia sem nota de inteligência publicada, sem benchmark de código e sem score agentic no catálogo. Em outras palavras, o fornecedor abriu a porta sem pendurar o quadro na parede.

O que está pendurado é a tabela de preços, e ela é agressiva. Entrada e cache custam US$ 0,09 por milhão de tokens; saída, US$ 0,45. Para efeito de comparação, o OpenAI o3 — que lidera o ranking de inteligência do dia — sai por US$ 8 por milhão de tokens. Estamos falando de quase 18 vezes mais barato no token de saída, sem que se saiba ainda qual é o custo real em qualidade.

O que significa "30B com 3B ativos"

A arquitetura é MoE: 30 bilhões de parâmetros totais, mas só 3 bilhões são ativados por token. Pense num restaurante com cardápio enorme e só três cozinheiros de plantão — a despensa é grande, mas quem efetivamente prepara o prato é uma fração. Isso explica o preço baixo de inferência: o que roda de verdade por token é leve, mesmo que o modelo "total" pareça pesado no papel.

A descrição oficial diz que o modelo foi otimizado para tarefas agentic de horizonte longo, do tipo "pesquise, leia, planeje, reescreva". Contexto de 131 mil tokens, corte de conhecimento em março de 2025. É um perfil de uso bem específico: não é o modelo que você chama para bate-papo, é o que você coloca para virar a noite lendo relatórios.

Ficha técnica — Tongyi DeepResearch 30B A3B
CampoValor
Identificadoralibaba/tongyi-deepresearch-30b-a3b
Criadoralibaba
Preço de entradaUS$ 0.090 / M tokens
Preço de saídaUS$ 0.450 / M tokens
Janela de contexto131k
Modalidadetext->text
Leitura de cacheUS$ 0.090 / M (0% de desconto)

Onde ele entra no tabuleiro

O catálogo desta data tem 229 modelos listados, vindos de 39 criadores, com 15 lançamentos nos últimos 30 dias. O topo de inteligência segue dominado pela OpenAI: o3 na frente com IQ 31,1, seguido do gpt-oss-120b com 24,1 e do Qwen3 Next 80B A3B Thinking com 16,9. O Tongyi DeepResearch não aparece nesse ranking — e, repito, não porque ficou de fora por nota ruim, mas porque a nota simplesmente não foi publicada.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 229 modelos disponíveis no catálogo nesta data.

Vale notar quem é o pai: Alibaba, via Tongyi Lab. O Qwen3 Next 80B A3B Thinking, que está no top 3 de inteligência e sai por US$ 1,20 por milhão de tokens de saída, vem da mesma casa. Ou seja, a Alibaba já tem um modelo caro e bem colocado; o Tongyi DeepResearch é a aposta barata e vertical em pesquisa profunda.

Para quem vale — e para quem não muda nada

Se você roda fluxos agentic que consomem muito contexto e emitem relativamente pouco — sumarizar dezenas de PDFs, navegar e sintetizar, fazer varredura de código em repositório grande — o custo por execução cai drasticamente nesse preço de US$ 0,45 de saída. Para um trabalho de 100 mil tokens de saída, a conta fica em US$ 0,045; no o3, seria US$ 0,80. Em volume, isso muda a economia do produto.

Se, por outro lado, você precisa de nota de IQ auditada para vender o modelo para o cliente, ou se o seu caso de uso é raciocínio curto e respostas curtas, este não é o lugar. Sem benchmark público, você está comprando no escuro — e a economia só se realiza se a qualidade agentic for compatível com a sua tarefa. O caminho sensato é testar com um conjunto representativo antes de migrar produção.

O que fazer com isso hoje

Trate o Tongyi DeepResearch 30B A3B como uma opção de custo para workloads agentic de horizonte longo, não como substituto do modelo principal. Mantenha o o3 ou o Qwen3 Thinking para o que exige raciocínio pesado; use o Tongyi para o que exige muitas chamadas e muito contexto. E espere a nota de inteligência aparecer — quando vier, ela vai dizer se os 18x de economia no token de saída eram reais ou só marketing.

Em uma frase

Para fluxos agentic que queimam muito contexto e pouca saída, vale testar como camada de custo; para tudo que precisa de nota auditada, espere o benchmark.

Perguntas frequentes

Quanto custa o Tongyi DeepResearch 30B A3B?

US$ 0,09 por milhão de tokens de entrada e cache, e US$ 0,45 por milhão de tokens de saída. Não há camada gratuita publicada no catálogo.

O Tongyi DeepResearch tem nota de inteligência?

Não. No catálogo desta data, os campos de IQ, coding e agentic estão vazios para o modelo — o que significa que o criador ainda não publicou benchmark padronizado.

Quem é o criador e de onde vem?

Tongyi Lab, ligado à Alibaba. É da mesma casa do Qwen3 Next 80B A3B Thinking, que está entre os três mais inteligentes do catálogo.

Leia também