o3 da OpenAI ainda lidera, mas Haiku 4.5 cobra metade
Três dias após o lançamento, o modelo pequeno da Anthropic chega perto do topo do índice de inteligência com preço de saída 37% menor.
O anúncio que você viu e a conta que você paga
A Anthropic disse, no lançamento de 15 de outubro, que o Claude Haiku 4.5 entrega "inteligência quase de fronteira a uma fração do custo". Traduzindo do release para a planilha: o modelo cobra US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída, contra US$ 2 e US$ 8 do o3 da OpenAI. Em outras palavras, a fatura de um mesmo lote de respostas fica 37% menor no Haiku 4.5. O detalhe que o release não grita é que o cache de leitura do Haiku 4.5 também é cinco vezes mais barato: US$ 0,10 contra US$ 0,50 por milhão de tokens. Para quem faz chamadas longas com prompt repetido, isso muda o cálculo.
Onde cada um está no tabuleiro
O catálogo desta data lista 260 modelos de 40 criadores. O topo do índice de inteligência hoje é do o3, com 31,10, seguido logo atrás pelo Haiku 4.5, com 29,89. A diferença é de 1,2 ponto em uma escala que vai de zero a cem — pequena o suficiente para não aparecer em uso casual, grande o suficiente para importar em benchmarks de matemática e raciocínio visual.
Os dois são modelos de raciocínio, ambos americanos, ambos com janela de 200 mil tokens, ambos com pesos fechados. O o3 é de abril de 2025 e tem corte de conhecimento em junho de 2024; o Haiku 4.5 é de três dias atrás e a Anthropic não publicou corte de conhecimento no catálogo. Se você depende de informação recente, isso pesa.
O que muda na ponta do lápis
Pegue um trabalho típico: 1 milhão de tokens de entrada e 200 mil de saída. No o3, a conta fecha em US$ 3,60. No Haiku 4.5, em US$ 2,00. Em volume — digamos 100 lotes desse por mês — a diferença é de US$ 160, ou quase R$ 900. Não é troco de padaria quando o projeto roda o ano inteiro.
O o3 tem velocidade média de 108,93 tokens por segundo contra 90,21 do Haiku 4.5. Em fluxos interativos, isso é perceptível. Em pipelines noturnos, ninguém nota.
Onde o o3 ainda ganha
O o3 lidera o índice de inteligência e tem velocidade maior. Em tarefas onde cada ponto de raciocínio conta — prova formal, depuração de código intricado, análise de imagem técnica — o o3 entrega mais. O catálogo também atribui ao o3 o título de padrão para "matemática, ciência, código e raciocínio visual" na própria descrição. É a escolha quando o trabalho é difícil e o orçamento não é o gargalo.
Onde o Haiku 4.5 já ganha
O Haiku 4.5 ganha em três frentes mensuráveis: preço de entrada (metade), preço de saída (37% menor) e preço de cache (cinco vezes menor). Para fluxos agentic, o catálogo registra nota de agentic de 16,47 e de coding de 43,89 — números que o o3 não tem publicados nesta data. Se o seu caso é um agente que faz muitas chamadas curtas com o mesmo system prompt, o Haiku 4.5 paga a conta com folga.
| Critério | o3 | Claude Haiku 4.5 |
|---|---|---|
| Índice de inteligência | 31.1 | 29.9 |
| Entrada US$/M | 2 | 1 |
| Saída US$/M | 8 | 5 |
| Contexto | 200k | 200k |
| Pesos abertos | não | não |
| Velocidade (tok/s) | 109 | 90 |
| Índice de código | — | 43.9 |
| Índice agêntico | — | 16.5 |
Para quem vale cada um
Se você roda agente, RAG com prompt fixo, classificação, extração ou qualquer fluxo de alto volume com latência tolerável, o Haiku 4.5 é a escolha racional nesta data. Você entrega 96% da inteligência do topo por 55% do preço blended.
Se você precisa do melhor raciocínio disponível, da maior velocidade por token e de um corte de conhecimento documentado, o o3 continua sendo o padrão. A diferença de 1,2 ponto no índice pode ser a diferença entre uma prova que fecha e uma que não fecha.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
A regra prática: orçamento apertado e volume alto, vá de Haiku 4.5. Tarefa difícil e velocidade importa, fique no o3.
Troque para o Haiku 4.5 em fluxos agentic e de alto volume; mantenha o o3 para tarefas em que cada ponto de raciocínio e cada milissegundo contam.
Perguntas frequentes
Claude Haiku 4.5 é mais barato que o o3?
Sim. O Haiku 4.5 cobra US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de saída, contra US$ 2 e US$ 8 do o3. O preço blended fica em US$ 2,00 contra US$ 3,50.
Qual tem o maior índice de inteligência, o3 ou Haiku 4.5?
O o3 lidera com 31,10 pontos, seguido pelo Haiku 4.5 com 29,89. A diferença é de 1,2 ponto na escala do catálogo.
Os dois modelos são de raciocínio?
Sim. Ambos são listados como modelos de raciocínio, ambos com pesos fechados, ambos dos Estados Unidos, e ambos com janela de contexto de 200 mil tokens.