gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês
Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.
Você olha o preço de saída e pensa que errou a casa decimal. O gpt-oss-20b da OpenAI cobra US$ 0,13 por milhão de tokens de saída; o ERNIE 4.5 300B A47B, da Baidu, cobra US$ 1,10 pela mesma unidade. Em um trabalho que custa US$ 1 no chinês, o americano sai por US$ 0,118. É quase nove vezes mais barato — e os dois são modelos abertos, com pesos publicados, arquitetura MoE, e janela de 128 mil tokens.
O que cada um traz no papel
O gpt-oss-20b é um MoE de 21 bilhões de parâmetros totais com apenas 3,6 bilhões ativos por passada. Foi liberado pela OpenAI em 5 de agosto sob Apache 2.0, tem modo de raciocínio e corte de conhecimento em junho de 2024. O ERNIE 4.5 300B A47B, da Baidu, é um gigante: 300 bilhões de parâmetros totais, 47 bilhões ativos por token, lançado em 30 de junho, sem modo de raciocínio declarado e com corte de conhecimento em março de 2025 — mais recente.
No índice de inteligência da Artificial Analysis medido hoje, o gpt-oss-20b marca 15,225 contra 8,867 do ERNIE. Em codificação, a vantagem do americano se mantém: 20,697 contra nota não divulgada pelo Baidu. Em tarefas agentic, 3,103 contra valor também não publicado. Ou seja, nos quesitos em que o ERNIE tem número publicado, ele perde.
A conta que ninguém quer fazer
O marketing chinês costuma destacar o número total de parâmetros — 300 bilhões chama atenção. Só que parâmetro total parado não gera resposta: o que consome GPU a cada token são os 47 bilhões ativos. É a diferença entre ter 300 carros na garagem e poder usar 47 ao mesmo tempo no trânsito. Para efeito de custo de inferência, o que conta é o ativo.
Traduzindo o release: o ERNIE não é “mais barato por ser maior”. Pelo contrário. O preço de entrada também é quase dez vezes maior (US$ 0,28 contra US$ 0,03 por milhão), e o cache de leitura nem foi divulgado pela Baidu — o que, na prática, significa que você não sabe quanto vai pagar ao reutilizar prompts. O gpt-oss-20b cobra US$ 0,03 no cache, igualando o preço de entrada.
Onde cada um ganha
| Critério | gpt-oss-20b | ERNIE 4.5 300B A47B |
|---|---|---|
| Índice de inteligência | 15.2 | 8.9 |
| Entrada US$/M | 0.03 | 0.28 |
| Saída US$/M | 0.13 | 1.1 |
| Contexto | 131k | 131k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 113 | — |
| Índice de código | 20.7 | — |
| Índice agêntico | 3.1 | — |
Se você precisa de raciocínio, codificação medida e quer pagar pouco por token, o gpt-oss-20b é a escolha óbvia. Velocidade publicada de 112,6 tokens por segundo, índice de inteligência superior e custo de saída que permite rodar agentes longos sem surpresa na fatura.
O ERNIE 4.5 300B A47B faz sentido em um cenário específico: aplicações que dependem de conhecimento cutoff mais recente (março de 2025 contra junho de 2024) e que precisam de um MoE massivo em self-hosting, onde o preço de API vira irrelevante porque você roda na sua própria infra. Para o desenvolvedor que consome via API e olha a conta no fim do mês, o gpt-oss-20b ganha em quase todas as linhas.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
| Llama 4 Scout | 10.3 | 0.3 |
Olhando o topo do mercado hoje, o o3 da OpenAI lidera com índice 31,096 a US$ 8 por milhão de tokens de saída — referência de capacidade, não de economia. O gpt-oss-20b e o gpt-oss-120b ocupam a faixa intermediária com preços de US$ 0,13 e US$ 0,17. O ERNIE fica abaixo nessa faixa, pagando caro pela nota que entrega.
O que isso muda na sua pilha
Se você está rodando um agente que gasta muitos tokens de saída, a diferença entre US$ 0,13 e US$ 1,10 por milhão é a diferença entre um projeto que cabe no cartão corporativo e um que precisa de orçamento aprovado. O gpt-oss-20b entrou no catálogo como a opção de raciocínio barato da OpenAI; o ERNIE 4.5, como o argumento de que “chinês é mais barato”, tropeça nos próprios números publicados.
Para consumo via API com raciocínio e codificação, escolha gpt-oss-20b; recorra ao ERNIE 4.5 apenas se precisar de knowledge cutoff de março de 2025 e rodar em infraestrutura própria.
Perguntas frequentes
gpt-oss-20b é realmente mais barato que o ERNIE 4.5?
Sim, nos preços publicados hoje: US$ 0,13 contra US$ 1,10 por milhão de tokens de saída, quase nove vezes de diferença. No preço de entrada a proporção é semelhante.
Os dois modelos são abertos?
Sim, ambos publicam pesos sob licença permissiva (Apache 2.0 no gpt-oss-20b; o ERNIE 4.5 também é listado como open weights). Dá para baixar e rodar na sua própria infra, mas via API o gpt-oss-20b é drasticamente mais barato.
Quando o ERNIE 4.5 compensa?
Quando o knowledge cutoff de março de 2025 importa para a tarefa e quando você vai hospedar o modelo localmente, anulando o preço de API. Para tudo que consome via endpoint, o gpt-oss-20b entrega nota maior por uma fração do custo.