FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

o3 da OpenAI ainda lidera, mas Haiku 4.5 cobra metade

Três dias após o lançamento, o modelo pequeno da Anthropic chega perto do topo do índice de inteligência com preço de saída 37% menor.

Redação FalaVIP IA 3 min de leitura
US$ 5,00preço de saída por milhão de tokens do Claude Haiku 4.5
US$ 8,00preço de saída por milhão de tokens do o3
29,89índice de inteligência do Haiku 4.5 contra 31,10 do o3

O anúncio que você viu e a conta que você paga

A Anthropic disse, no lançamento de 15 de outubro, que o Claude Haiku 4.5 entrega "inteligência quase de fronteira a uma fração do custo". Traduzindo do release para a planilha: o modelo cobra US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída, contra US$ 2 e US$ 8 do o3 da OpenAI. Em outras palavras, a fatura de um mesmo lote de respostas fica 37% menor no Haiku 4.5. O detalhe que o release não grita é que o cache de leitura do Haiku 4.5 também é cinco vezes mais barato: US$ 0,10 contra US$ 0,50 por milhão de tokens. Para quem faz chamadas longas com prompt repetido, isso muda o cálculo.

Onde cada um está no tabuleiro

O catálogo desta data lista 260 modelos de 40 criadores. O topo do índice de inteligência hoje é do o3, com 31,10, seguido logo atrás pelo Haiku 4.5, com 29,89. A diferença é de 1,2 ponto em uma escala que vai de zero a cem — pequena o suficiente para não aparecer em uso casual, grande o suficiente para importar em benchmarks de matemática e raciocínio visual.

Índice de inteligência (Artificial Analysis)
o331,1Claude Haiku 4.529,9índice
Fonte: Artificial Analysis

Os dois são modelos de raciocínio, ambos americanos, ambos com janela de 200 mil tokens, ambos com pesos fechados. O o3 é de abril de 2025 e tem corte de conhecimento em junho de 2024; o Haiku 4.5 é de três dias atrás e a Anthropic não publicou corte de conhecimento no catálogo. Se você depende de informação recente, isso pesa.

O que muda na ponta do lápis

Pegue um trabalho típico: 1 milhão de tokens de entrada e 200 mil de saída. No o3, a conta fecha em US$ 3,60. No Haiku 4.5, em US$ 2,00. Em volume — digamos 100 lotes desse por mês — a diferença é de US$ 160, ou quase R$ 900. Não é troco de padaria quando o projeto roda o ano inteiro.

Preço de saída (US$ por milhão de tokens)
o38Claude Haiku 4.55US$/M
Fonte: OpenRouter

O o3 tem velocidade média de 108,93 tokens por segundo contra 90,21 do Haiku 4.5. Em fluxos interativos, isso é perceptível. Em pipelines noturnos, ninguém nota.

Onde o o3 ainda ganha

O o3 lidera o índice de inteligência e tem velocidade maior. Em tarefas onde cada ponto de raciocínio conta — prova formal, depuração de código intricado, análise de imagem técnica — o o3 entrega mais. O catálogo também atribui ao o3 o título de padrão para "matemática, ciência, código e raciocínio visual" na própria descrição. É a escolha quando o trabalho é difícil e o orçamento não é o gargalo.

Onde o Haiku 4.5 já ganha

O Haiku 4.5 ganha em três frentes mensuráveis: preço de entrada (metade), preço de saída (37% menor) e preço de cache (cinco vezes menor). Para fluxos agentic, o catálogo registra nota de agentic de 16,47 e de coding de 43,89 — números que o o3 não tem publicados nesta data. Se o seu caso é um agente que faz muitas chamadas curtas com o mesmo system prompt, o Haiku 4.5 paga a conta com folga.

o3 × Claude Haiku 4.5
Critérioo3Claude Haiku 4.5
Índice de inteligência31.129.9
Entrada US$/M21
Saída US$/M85
Contexto200k200k
Pesos abertosnãonão
Velocidade (tok/s)10990
Índice de código43.9
Índice agêntico16.5

Para quem vale cada um

Se você roda agente, RAG com prompt fixo, classificação, extração ou qualquer fluxo de alto volume com latência tolerável, o Haiku 4.5 é a escolha racional nesta data. Você entrega 96% da inteligência do topo por 55% do preço blended.

Se você precisa do melhor raciocínio disponível, da maior velocidade por token e de um corte de conhecimento documentado, o o3 continua sendo o padrão. A diferença de 1,2 ponto no índice pode ser a diferença entre uma prova que fecha e uma que não fecha.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 260 modelos disponíveis no catálogo nesta data.

A regra prática: orçamento apertado e volume alto, vá de Haiku 4.5. Tarefa difícil e velocidade importa, fique no o3.

Em uma frase

Troque para o Haiku 4.5 em fluxos agentic e de alto volume; mantenha o o3 para tarefas em que cada ponto de raciocínio e cada milissegundo contam.

Perguntas frequentes

Claude Haiku 4.5 é mais barato que o o3?

Sim. O Haiku 4.5 cobra US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de saída, contra US$ 2 e US$ 8 do o3. O preço blended fica em US$ 2,00 contra US$ 3,50.

Qual tem o maior índice de inteligência, o3 ou Haiku 4.5?

O o3 lidera com 31,10 pontos, seguido pelo Haiku 4.5 com 29,89. A diferença é de 1,2 ponto na escala do catálogo.

Os dois modelos são de raciocínio?

Sim. Ambos são listados como modelos de raciocínio, ambos com pesos fechados, ambos dos Estados Unidos, e ambos com janela de contexto de 200 mil tokens.

Leia também