FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês

Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.

Redação FalaVIP IA 3 min de leitura
0,13 vs 1,10US$ por milhão de tokens de saída
15,225 vs 8,867índice de inteligência (Artificial Analysis)
21B / 3,6B ativosparâmetros do gpt-oss-20b

Você olha o preço de saída e pensa que errou a casa decimal. O gpt-oss-20b da OpenAI cobra US$ 0,13 por milhão de tokens de saída; o ERNIE 4.5 300B A47B, da Baidu, cobra US$ 1,10 pela mesma unidade. Em um trabalho que custa US$ 1 no chinês, o americano sai por US$ 0,118. É quase nove vezes mais barato — e os dois são modelos abertos, com pesos publicados, arquitetura MoE, e janela de 128 mil tokens.

O que cada um traz no papel

O gpt-oss-20b é um MoE de 21 bilhões de parâmetros totais com apenas 3,6 bilhões ativos por passada. Foi liberado pela OpenAI em 5 de agosto sob Apache 2.0, tem modo de raciocínio e corte de conhecimento em junho de 2024. O ERNIE 4.5 300B A47B, da Baidu, é um gigante: 300 bilhões de parâmetros totais, 47 bilhões ativos por token, lançado em 30 de junho, sem modo de raciocínio declarado e com corte de conhecimento em março de 2025 — mais recente.

Índice de inteligência (Artificial Analysis)
gpt-oss-20b15,2ERNIE 4.5 300B A47B 8,9índice
Fonte: Artificial Analysis

No índice de inteligência da Artificial Analysis medido hoje, o gpt-oss-20b marca 15,225 contra 8,867 do ERNIE. Em codificação, a vantagem do americano se mantém: 20,697 contra nota não divulgada pelo Baidu. Em tarefas agentic, 3,103 contra valor também não publicado. Ou seja, nos quesitos em que o ERNIE tem número publicado, ele perde.

A conta que ninguém quer fazer

O marketing chinês costuma destacar o número total de parâmetros — 300 bilhões chama atenção. Só que parâmetro total parado não gera resposta: o que consome GPU a cada token são os 47 bilhões ativos. É a diferença entre ter 300 carros na garagem e poder usar 47 ao mesmo tempo no trânsito. Para efeito de custo de inferência, o que conta é o ativo.

Preço de saída (US$ por milhão de tokens)
gpt-oss-20b0,13ERNIE 4.5 300B A47B 1,1US$/M
Fonte: OpenRouter

Traduzindo o release: o ERNIE não é “mais barato por ser maior”. Pelo contrário. O preço de entrada também é quase dez vezes maior (US$ 0,28 contra US$ 0,03 por milhão), e o cache de leitura nem foi divulgado pela Baidu — o que, na prática, significa que você não sabe quanto vai pagar ao reutilizar prompts. O gpt-oss-20b cobra US$ 0,03 no cache, igualando o preço de entrada.

Onde cada um ganha

gpt-oss-20b × ERNIE 4.5 300B A47B
Critériogpt-oss-20bERNIE 4.5 300B A47B
Índice de inteligência15.28.9
Entrada US$/M0.030.28
Saída US$/M0.131.1
Contexto131k131k
Pesos abertossimsim
Velocidade (tok/s)113
Índice de código20.7
Índice agêntico3.1

Se você precisa de raciocínio, codificação medida e quer pagar pouco por token, o gpt-oss-20b é a escolha óbvia. Velocidade publicada de 112,6 tokens por segundo, índice de inteligência superior e custo de saída que permite rodar agentes longos sem surpresa na fatura.

O ERNIE 4.5 300B A47B faz sentido em um cenário específico: aplicações que dependem de conhecimento cutoff mais recente (março de 2025 contra junho de 2024) e que precisam de um MoE massivo em self-hosting, onde o preço de API vira irrelevante porque você roda na sua própria infra. Para o desenvolvedor que consome via API e olha a conta no fim do mês, o gpt-oss-20b ganha em quase todas as linhas.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Llama 4 Scout10.30.3
Entre os 224 modelos disponíveis no catálogo nesta data.

Olhando o topo do mercado hoje, o o3 da OpenAI lidera com índice 31,096 a US$ 8 por milhão de tokens de saída — referência de capacidade, não de economia. O gpt-oss-20b e o gpt-oss-120b ocupam a faixa intermediária com preços de US$ 0,13 e US$ 0,17. O ERNIE fica abaixo nessa faixa, pagando caro pela nota que entrega.

O que isso muda na sua pilha

Se você está rodando um agente que gasta muitos tokens de saída, a diferença entre US$ 0,13 e US$ 1,10 por milhão é a diferença entre um projeto que cabe no cartão corporativo e um que precisa de orçamento aprovado. O gpt-oss-20b entrou no catálogo como a opção de raciocínio barato da OpenAI; o ERNIE 4.5, como o argumento de que “chinês é mais barato”, tropeça nos próprios números publicados.

Em uma frase

Para consumo via API com raciocínio e codificação, escolha gpt-oss-20b; recorra ao ERNIE 4.5 apenas se precisar de knowledge cutoff de março de 2025 e rodar em infraestrutura própria.

Perguntas frequentes

gpt-oss-20b é realmente mais barato que o ERNIE 4.5?

Sim, nos preços publicados hoje: US$ 0,13 contra US$ 1,10 por milhão de tokens de saída, quase nove vezes de diferença. No preço de entrada a proporção é semelhante.

Os dois modelos são abertos?

Sim, ambos publicam pesos sob licença permissiva (Apache 2.0 no gpt-oss-20b; o ERNIE 4.5 também é listado como open weights). Dá para baixar e rodar na sua própria infra, mas via API o gpt-oss-20b é drasticamente mais barato.

Quando o ERNIE 4.5 compensa?

Quando o knowledge cutoff de março de 2025 importa para a tarefa e quando você vai hospedar o modelo localmente, anulando o preço de API. Para tudo que consome via endpoint, o gpt-oss-20b entrega nota maior por uma fração do custo.

Leia também