FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

ERNIE 4.5 21B da Baidu custa US$ 0,07 de entrada — vale o teste?

Modelo leve chinês lançado há sete dias aposta em raciocínio a preço baixo; o catálogo ainda não publicou nota de inteligência nem benchmark de código.

Redação FalaVIP IA 3 min de leitura
US$ 0,07por milhão de tokens de entrada
US$ 0,28por milhão de tokens de saída
131.072tokens de contexto

Sete dias após o lançamento, o catálogo já lista 259 modelos e 32 deles chegaram nas últimas quatro semanas. Dentro desse enxame, a Baidu empurrou para a vitrine um modelo de 21 bilhões de parâmetros com receita de raciocínio "thinking" — o ERNIE 4.5 21B A3B Thinking — vendido a US$ 0,07 o milhão de tokens de entrada e US$ 0,28 o de saída. A pergunta que importa é simples: esse preço conversa com a qualidade que ele entrega?

O que está na ficha e o que está faltando

O modelo é texto para texto, aceita 131.072 tokens de contexto e tem corte de conhecimento em março de 2025. É um MoE "leve", descrição da própria Baidu: ajustado para aprofundar raciocínio em lógica, matemática, ciência, código, geração de texto e benchmarks acadêmicos de nível especialista. Até aqui, tudo promessa de release.

O problema é o que a ficha não traz. O catálogo não publicou nota de inteligência, nem benchmark de código, nem índice agentic, nem preço de cache. Sem esses números, você não consegue comparar o ERNIE 4.5 21B com o restante do mercado usando régua — só régua de preço.

Ficha técnica — ERNIE 4.5 21B A3B Thinking
CampoValor
Identificadorbaidu/ernie-4.5-21b-a3b-thinking
Criadorbaidu
Preço de entradaUS$ 0.070 / M tokens
Preço de saídaUS$ 0.280 / M tokens
Janela de contexto131k
Modalidadetext->text

O preço de US$ 0,07 contra o que está no topo

Olha o topo do catálogo hoje: o OpenAI o3 lidera com IQ 31 e cobra US$ 8 por milhão de tokens de saída. O Claude Haiku 4.5 vem logo abaixo, IQ 29,9, a US$ 5. O gpt-oss-120b, da própria OpenAI, marca IQ 24 por US$ 0,17 de saída. O Qwen3 Next 80B A3B Thinking, também chinês e também "thinking", aparece com IQ 16,9 a US$ 1,20.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 259 modelos disponíveis no catálogo nesta data.

A conta mais óbvia: o ERNIE 4.5 21B cobra US$ 0,28 de saída — menos que o Claude Haiku 4.5 (US$ 5), menos que o o3 (US$ 8), mais barato que o Qwen3 Next Thinking (US$ 1,20) e mais caro que o gpt-oss-120b (US$ 0,17). É um preço intermediário-baixo. Mas preço sem nota de inteligência é etiqueta sem produto: você não sabe se está pagando US$ 0,28 por um modelo de IQ 25 ou de IQ 12.

Para quem esse modelo faz sentido

Se você roda muito texto em chinês, a Baidu é fornecedor histórico nesse idioma e o corte de conhecimento de março de 2025 é recente — vale um teste de aceitação no seu pipeline antes de comprometer volume.

Se o seu gargalo é custo por chamada em tarefas que pedem raciocínio e você já testou o gpt-oss-120b sem gostar do resultado, o ERNIE 4.5 21B entra como terceira opção barata atrás dele e à frente do Qwen3 Next Thinking — com a ressalva de que você está comprando no escuro até sair benchmark público.

Se você precisa de 131k de contexto com thinking ligado e o o3 ou o Claude Sonnet estão comendo sua margem, o preço de entrada do ERNIE é uma das rotas mais em conta do catálogo hoje.

Para quem NÃO muda nada

Se seu fluxo é agentic com tool use pesado, o catálogo não publicou índice agentic para esse modelo — passe reto até alguém medir.

Se você já padronizou em OpenAI ou Anthropic e o custo da API não é o gargalo, trocar por um modelo sem nota de inteligência publicada só adiciona risco de qualidade.

Se você precisa de cache hit barato para reduzir custo em prompts repetidos, o campo de cache está vazio na ficha — não dá para orçar sem assumir valor.

O tabuleiro em 16 de outubro de 2025

A Baidu é uma das 40 criadoras listadas no catálogo. O país de origem não consta na ficha, mas a empresa é chinesa e o modelo compete diretamente com o Qwen3 Next Thinking, também chinês, também MoE, também "thinking" — só que com nota de inteligência publicada (IQ 16,9) e preço de saída quase cinco vezes maior. O ERNIE 4.5 21B é a aposta da Baidu em ocupar a faixa "barato e capaz" que o gpt-oss-120b da OpenAI já está disputando a US$ 0,17 de saída.

A implicação é direta: aguarde um ou dois benchmarks independentes antes de mover carga. Se a nota de inteligência vier acima de 20, o preço de US$ 0,28 de saída vira um dos melhores do catálogo para raciocínio. Se vier abaixo de 15, é só mais um modelo chinês barato sem diferencial claro.

Em uma frase

Teste o ERNIE 4.5 21B em中文 e em tarefas de raciocínio se custo é gargalo, mas não mova carga de produção até sair benchmark independente — a ficha não traz nota de inteligência nem preço de cache.

Perguntas frequentes

Quanto custa o ERNIE 4.5 21B A3B Thinking?

US$ 0,07 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída. O catálogo não publicou preço de cache nem nota de inteligência para esse modelo.

O ERNIE 4.5 21B é melhor que o gpt-oss-120b?

Sem benchmark público no catálogo, não dá para afirmar. O gpt-oss-120b custa US$ 0,17 de saída (mais barato) e tem IQ 24 publicado; o ERNIE 4.5 21B custa US$ 0,28 e ainda não tem nota.

Vale trocar de modelo por causa do preço do ERNIE 4.5 21B?

Só se custo for gargalo real e você rodar tarefas em chinês ou de raciocínio. Sem nota de inteligência nem índice agentic publicados, mover carga de produção adiciona risco de qualidade.

Leia também