Olmo 3 32B Think chega por US$ 0,50 por milhão de tokens de saída
Modelo de raciocínio da AllenAI entra no catálogo custando menos de um terço do Claude Haiku 4.5 — mas sem índice de inteligência publicado até agora.
O preço que aparece na fatura
Você abre o painel da API, olha o catálogo de modelos de raciocínio e vê o Claude Haiku 4.5 custando US$ 5 por milhão de tokens de saída. Logo abaixo, o OpenAI o3 cobra US$ 8. Aí aparece um terceiro nome, AllenAI: Olmo 3 32B Think, com a mesma proposta — raciocínio profundo, cadeia lógica longa, instruções complexas — por US$ 0,50. É o tipo de diferença que faz você conferir duas vezes se o catálogo não bugou.
O número não está errado. Está no catálogo hoje, 21 de novembro de 2025, junto com mais 278 modelos de 43 criadores. O Olmo 3 32B Think é um modelo de 32 bilhões de parâmetros construído pela AllenAI especificamente para tarefas de raciocínio, com janela de contexto de 65.536 tokens. A descrição oficial fala em "deep reasoning, complex logic chains e advanced instruction-following" — o mesmo vocabulário que você lê nas fichas do o3 e do Haiku 4.5.
O que muda na conta
A conta muda muito, e é aqui que a conversa fica interessante. Pega um cenário comum: você está rodando um agente que consome 1 milhão de tokens de saída por dia para processar tickets de suporte com raciocínio encadeado. No Haiku 4.5, isso é US$ 5 por dia, US$ 150 por mês. No o3, são US$ 240 por mês. No Olmo 3 32B Think, são US$ 15 por mês — uma economia de 90% em relação ao o3 e de 90% em relação ao Haiku 4.5.
O custo de entrada também é agressivo: US$ 0,15 por milhão de tokens, contra US$ 5 e US$ 8 dos rivais diretos. Em fluxos onde o gargalo é a entrada — por exemplo, analisar documentos longos antes de gerar uma resposta curta — a economia é proporcional.
A peça que falta
Tem um porém, e ele é grande. O catálogo não publicou índice de inteligência para o Olmo 3 32B Think. Não tem nota de IQ, não tem benchmark de coding, não tem score agentic, não tem blended. Você está comprando um modelo de raciocínio sem saber onde ele se posiciona no ranking.
| Campo | Valor |
|---|---|
| Identificador | allenai/olmo-3-32b-think |
| Criador | allenai |
| Preço de entrada | US$ 0.150 / M tokens |
| Preço de saída | US$ 0.500 / M tokens |
| Janela de contexto | 66k |
| Modalidade | text->text |
Para efeito de comparação, o topo do catálogo hoje tem o OpenAI o3 com IQ 31,096 e o Claude Haiku 4.5 com IQ 29,892 — ambos cobrando 10 a 16 vezes mais por token de saída. O gpt-oss-120b, da própria OpenAI, aparece com IQ 24,126 e preço de US$ 0,17 por milhão de tokens de saída, ou seja, mais barato que o Olmo. A pergunta que fica é: o Olmo 3 32B Think entrega raciocínio de nível o3 por um terço do preço do Haiku, ou entrega algo mais próximo do gpt-oss-120b por um preço parecido?
Para quem vale e para quem não muda nada
Vale para você se: está rodando cargas de raciocínio com orçamento apertado, precisa de uma alternativa ao Haiku 4.5 para testes A/B sem estourar a fatura, ou quer um modelo de 32B com contexto de 65k tokens para cadeias lógicas longas e está disposto a avaliar qualidade por conta própria antes de colocar em produção.
Não muda nada para você se: já tem um fluxo crítico rodando no o3 ou no Haiku 4.5 com qualidade validada e o custo é marginal no seu orçamento; depende de benchmarks públicos para justificar a escolha internamente; ou precisa de garantias de SLA empresarial que um modelo recém-chegado ao catálogo ainda não tem track record para oferecer.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Olmo 3 32B Think (o novo) | — | 0.15 | 0.5 | 66k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
O tabuleiro agora
Em 21 de novembro, o catálogo tem 279 modelos listados e 18 lançamentos nos últimos 30 dias. A faixa de modelos de raciocínio "acessíveis" está ficando lotada: OpenAI contribuiu com o gpt-oss-120b (US$ 0,17 saída) e o gpt-oss-20b (US$ 0,13 saída), Qwen tem o Qwen3 Next 80B A3B Thinking (US$ 1,20), e agora a AllenAI entra com o Olmo 3 32B Think (US$ 0,50). A pressão de preço sobre o Haiku 4.5 e o o3 é real — mesmo que a AllenAI ainda não tenha publicado os números de inteligência para provar que a economia não vem com perda de qualidade.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
A implicação prática é direta: antes de migrar qualquer fluxo de produção, rode um lote de 100 a 500 chamadas reais no Olmo 3 32B Think e compare com o modelo que você usa hoje. Meça taxa de acerto, latência e qualidade percebida. Se o resultado se sustentar, a economia anual pode pagar um engenheiro júnior. Se não se sustentar, você volta para o modelo anterior sabendo que testou a opção mais barata disponível.
Teste o Olmo 3 32B Think em um lote controlado antes de migrar qualquer fluxo: o preço é 10 vezes menor que o do o3, mas sem índice de inteligência publicado, só uma avaliação real no seu caso de uso diz se a economia vale.
Perguntas frequentes
Quanto custa o Olmo 3 32B Think?
US$ 0,15 por milhão de tokens de entrada e US$ 0,50 por milhão de tokens de saída, com janela de contexto de 65.536 tokens. É um dos modelos de raciocínio mais baratos do catálogo hoje.
O Olmo 3 32B Think tem benchmark de inteligência publicado?
Não. O catálogo não publicou índice de inteligência, score de coding nem score agentic para esse modelo até a data de lançamento. A comparação com o3 e Haiku 4.5 só pode ser feita com testes próprios.
O Olmo 3 32B Think é melhor que o gpt-oss-120b?
Sem dados públicos de benchmark para o Olmo, não dá para afirmar. O gpt-oss-120b custa US$ 0,17 por milhão de tokens de saída (mais barato) e tem IQ 24,126 publicado. A comparação de qualidade precisa ser feita caso a caso.