FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Maverick custa 37% menos e pontua 63% mais que o ERNIE 4.5

O MoE americano de 17B ativos vence o chinês de 47B em quase tudo — exceto quando idioma, recência ou jurisdição pesam.

Redação FalaVIP IA 3 min de leitura
14,477 vs 8,867índice de inteligência (Artificial Analysis)
US$ 0,696 vs US$ 1,10preço por milhão de tokens de saída
1.048.576 vs 131.072janela de contexto em tokens

O tamanho não é tudo

Sessenta e três por cento mais alto no índice de inteligência. Trinta e sete por cento mais barato na saída. Oito vezes mais janela de contexto. Quem leva esse cara a cara? O MoE que ativa 17 bilhões de parâmetros por token, não o que ativa 47.

Em outras palavras: o Llama 4 Maverick, da Meta, despacha o ERNIE 4.5 300B A47B, da Baidu, na maioria das métricas que importam para quem está fechando a fatura da API no fim do mês.

Inteligência e velocidade

Índice de inteligência (Artificial Analysis)
Llama 4 Maverick14,5ERNIE 4.5 300B A47B 8,9índice
Fonte: Artificial Analysis

Olha a régua do Artificial Analysis: Maverick marca 14,477 no índice de inteligência, contra 8,867 do ERNIE. É a distância entre o quinto colocado entre os modelos abertos com peso liberado e um chinês que ficou pelo meio do caminho na geração anterior.

Em codificação, o padrão se repete: 16,277 para o Maverick, sem nota pública para o ERNIE 4.5 300B A47B no catálogo. Em tarefas agentic, 1,237 contra dado ausente. Onde a régua existe, o Maverick vence. No recorte blended — aquele que pondera qualidade e custo — o ERNIE empata e até passa: 0,485 contra 0,4225.

Aqui está a primeira nuance: se você medir inteligência por dólar, os dois ficam perto. Mas isso porque o ERNIE tem entrada ligeiramente mais barata e a régua blended recompensa preço, não porque entrega o mesmo nível de resposta. O IQ quase 64% maior do Maverick continua lá, pagando ou não.

Preço, contexto e multimodalidade

Preço de saída (US$ por milhão de tokens)
Llama 4 Maverick0,696ERNIE 4.5 300B A47B 1,1US$/M
Fonte: OpenRouter

O pacote comercial pesa diferente. Maverick cobra US$ 0,20 por milhão de tokens de entrada e US$ 0,696 de saída. ERNIE 4.5 cobra US$ 0,28 de entrada e US$ 1,10 de saída. Em volume real — numa aplicação com 1 para 4 entre entrada e saída, que é o padrão de chatbot — o Maverick custa quase a metade por requisição.

A janela de contexto é outro abismo: 1.048.576 tokens do Maverick contra 131.072 do ERNIE. Para quem carrega documento grande, base de código inteira ou transcrição de call, é a diferença entre caber e ter que cortar em pedaços.

E tem um recurso que o ERNIE 4.5 300B A47B simplesmente não oferece: multimodalidade. O Maverick é text+image→text. Recebe imagem, devolve texto. O chinês, hoje, é só text→text.

Onde o ERNIE 4.5 ainda responde

Três pontos onde o Baidu não está fora do jogo.

Conhecimento mais recente. Cutoff em 31 de março de 2025, contra 31 de agosto de 2024 do Maverick. São sete meses de diferença que importam em domínios que andam depressa — APIs novas, regulações, eventos.

Idioma e jurisdição. É um modelo chinês. Se a sua aplicação atende usuário final em mandarim com nuance local, ou se a sua stack de compliance pede modelo operado em jurisdição chinesa, o ERNIE entra na conversa por motivo que não é benchmark.

Workload curto e barato. O blended score ligeiramente melhor (0,485 vs 0,4225) sugere que, em chamadas curtas e de baixo volume, o ERNIE pode entregar retorno comparável por real gasto. Não é o caso de uso mais lucrativo, mas existe.

O veredito

Llama 4 Maverick × ERNIE 4.5 300B A47B
CritérioLlama 4 MaverickERNIE 4.5 300B A47B
Índice de inteligência14.58.9
Entrada US$/M0.20.28
Saída US$/M0.6961.1
Contexto1.05M131k
Pesos abertossimsim
Velocidade (tok/s)86
Índice de código16.3
Índice agêntico1.2

Escolha o Llama 4 Maverick se você quer a maior inteligência por dólar deste comparativo, multimodalidade nativa, contexto de 1 milhão de tokens e uma stack aberta americana. É o padrão para a maioria dos workloads de produção que envolvem código, documento longo ou entrada visual.

Escolha o ERNIE 4.5 300B A47B se o seu caso trava no mandarim, depende de eventos posteriores a agosto de 2024, ou se a sua organização opera com requisito de modelo chinês. Em tarefas curtas e de baixo volume, o custo por resposta também fica aceitável.

Não existe vencedor absoluto. Existe, sim, o seguinte: em nove em cada dez workloads ocidentais medidos hoje, a conta fecha melhor com o Maverick — e o ERNIE fica como opção de nicho regulatório, linguístico ou de recência.

Em uma frase

Para a maioria das aplicações ocidentais em produção, o Llama 4 Maverick entrega mais inteligência por menos dinheiro; o ERNIE 4.5 vale o preço só quando mandarim, recência ou compliance chinês entram na equação.

Perguntas frequentes

Llama 4 Maverick ou ERNIE 4.5: qual escolher?

Para a maioria dos workloads em inglês, código e documentos longos, o Llama 4 Maverick ganha em inteligência (14,477 vs 8,867), preço de saída (US$ 0,696 vs US$ 1,10) e janela de contexto (1M vs 131K). O ERNIE 4.5 entra quando há exigência de idioma chinês, recência maior ou jurisdição local.

Qual dos dois entende imagem?

Só o Llama 4 Maverick. A modalidade do ERNIE 4.5 300B A47B listada no catálogo é text→text; o Maverick é text+image→text e recebe imagem devolvendo texto.

O ERNIE 4.5 300B A47B é mais barato no final das contas?

Não. A entrada do ERNIE é mais barata (US$ 0,28 vs US$ 0,20… na verdade a do Maverick é mais barata), e a saída é US$ 1,10 contra US$ 0,696 do Maverick. Em uma proporção típica de 1:4 entre entrada e saída, o Maverick custa quase a metade por requisição.

Leia também