ERNIE 4.5 21B da Baidu custa US$ 0,07 de entrada — vale o teste?
Modelo leve chinês lançado há sete dias aposta em raciocínio a preço baixo; o catálogo ainda não publicou nota de inteligência nem benchmark de código.
Sete dias após o lançamento, o catálogo já lista 259 modelos e 32 deles chegaram nas últimas quatro semanas. Dentro desse enxame, a Baidu empurrou para a vitrine um modelo de 21 bilhões de parâmetros com receita de raciocínio "thinking" — o ERNIE 4.5 21B A3B Thinking — vendido a US$ 0,07 o milhão de tokens de entrada e US$ 0,28 o de saída. A pergunta que importa é simples: esse preço conversa com a qualidade que ele entrega?
O que está na ficha e o que está faltando
O modelo é texto para texto, aceita 131.072 tokens de contexto e tem corte de conhecimento em março de 2025. É um MoE "leve", descrição da própria Baidu: ajustado para aprofundar raciocínio em lógica, matemática, ciência, código, geração de texto e benchmarks acadêmicos de nível especialista. Até aqui, tudo promessa de release.
O problema é o que a ficha não traz. O catálogo não publicou nota de inteligência, nem benchmark de código, nem índice agentic, nem preço de cache. Sem esses números, você não consegue comparar o ERNIE 4.5 21B com o restante do mercado usando régua — só régua de preço.
| Campo | Valor |
|---|---|
| Identificador | baidu/ernie-4.5-21b-a3b-thinking |
| Criador | baidu |
| Preço de entrada | US$ 0.070 / M tokens |
| Preço de saída | US$ 0.280 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
O preço de US$ 0,07 contra o que está no topo
Olha o topo do catálogo hoje: o OpenAI o3 lidera com IQ 31 e cobra US$ 8 por milhão de tokens de saída. O Claude Haiku 4.5 vem logo abaixo, IQ 29,9, a US$ 5. O gpt-oss-120b, da própria OpenAI, marca IQ 24 por US$ 0,17 de saída. O Qwen3 Next 80B A3B Thinking, também chinês e também "thinking", aparece com IQ 16,9 a US$ 1,20.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
A conta mais óbvia: o ERNIE 4.5 21B cobra US$ 0,28 de saída — menos que o Claude Haiku 4.5 (US$ 5), menos que o o3 (US$ 8), mais barato que o Qwen3 Next Thinking (US$ 1,20) e mais caro que o gpt-oss-120b (US$ 0,17). É um preço intermediário-baixo. Mas preço sem nota de inteligência é etiqueta sem produto: você não sabe se está pagando US$ 0,28 por um modelo de IQ 25 ou de IQ 12.
Para quem esse modelo faz sentido
Se você roda muito texto em chinês, a Baidu é fornecedor histórico nesse idioma e o corte de conhecimento de março de 2025 é recente — vale um teste de aceitação no seu pipeline antes de comprometer volume.
Se o seu gargalo é custo por chamada em tarefas que pedem raciocínio e você já testou o gpt-oss-120b sem gostar do resultado, o ERNIE 4.5 21B entra como terceira opção barata atrás dele e à frente do Qwen3 Next Thinking — com a ressalva de que você está comprando no escuro até sair benchmark público.
Se você precisa de 131k de contexto com thinking ligado e o o3 ou o Claude Sonnet estão comendo sua margem, o preço de entrada do ERNIE é uma das rotas mais em conta do catálogo hoje.
Para quem NÃO muda nada
Se seu fluxo é agentic com tool use pesado, o catálogo não publicou índice agentic para esse modelo — passe reto até alguém medir.
Se você já padronizou em OpenAI ou Anthropic e o custo da API não é o gargalo, trocar por um modelo sem nota de inteligência publicada só adiciona risco de qualidade.
Se você precisa de cache hit barato para reduzir custo em prompts repetidos, o campo de cache está vazio na ficha — não dá para orçar sem assumir valor.
O tabuleiro em 16 de outubro de 2025
A Baidu é uma das 40 criadoras listadas no catálogo. O país de origem não consta na ficha, mas a empresa é chinesa e o modelo compete diretamente com o Qwen3 Next Thinking, também chinês, também MoE, também "thinking" — só que com nota de inteligência publicada (IQ 16,9) e preço de saída quase cinco vezes maior. O ERNIE 4.5 21B é a aposta da Baidu em ocupar a faixa "barato e capaz" que o gpt-oss-120b da OpenAI já está disputando a US$ 0,17 de saída.
A implicação é direta: aguarde um ou dois benchmarks independentes antes de mover carga. Se a nota de inteligência vier acima de 20, o preço de US$ 0,28 de saída vira um dos melhores do catálogo para raciocínio. Se vier abaixo de 15, é só mais um modelo chinês barato sem diferencial claro.
Teste o ERNIE 4.5 21B em中文 e em tarefas de raciocínio se custo é gargalo, mas não mova carga de produção até sair benchmark independente — a ficha não traz nota de inteligência nem preço de cache.
Perguntas frequentes
Quanto custa o ERNIE 4.5 21B A3B Thinking?
US$ 0,07 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída. O catálogo não publicou preço de cache nem nota de inteligência para esse modelo.
O ERNIE 4.5 21B é melhor que o gpt-oss-120b?
Sem benchmark público no catálogo, não dá para afirmar. O gpt-oss-120b custa US$ 0,17 de saída (mais barato) e tem IQ 24 publicado; o ERNIE 4.5 21B custa US$ 0,28 e ainda não tem nota.
Vale trocar de modelo por causa do preço do ERNIE 4.5 21B?
Só se custo for gargalo real e você rodar tarefas em chinês ou de raciocínio. Sem nota de inteligência nem índice agentic publicados, mover carga de produção adiciona risco de qualidade.