Claude Haiku 4.5 custa um terço do Sonnet e empata com ele em inteligência
Anthropic lança hoje a versão barata da família Claude, posicionada entre o o3 da OpenAI e os modelos abertos da Qwen — e com preço de saída abaixo dos US$ 5 por milhão de tokens.
O Haiku 4.5 chegou perto do topo — e cobrou caro para isso
Você já viu o anúncio da Anthropic dizendo que o Haiku 4.5 é o modelo "rápido e barato" da família Claude. O número que importa, porém, está no meio da frase: barato em relação a quê? O preço de saída do Haiku 4.5 é US$ 5 por milhão de tokens. É mais barato que o o3 da OpenAI (US$ 8 por milhão), mas não é pechincha. O que muda é o que você recebe por esse valor.
Onde ele se encaixa no tabuleiro
Hoje o catálogo tem 258 modelos listados, vindos de 40 criadores. No índice de inteligência da Artificial Analysis, o Haiku 4.5 marca 29,89 — a segunda maior nota entre todos os modelos disponíveis, atrás apenas do o3 (31,10). Em outras palavras: é o segundo modelo mais inteligente do catálogo no momento em que este texto é publicado. Para um modelo da linha "leve" da Anthropic, é um salto relevante.
A leitura prática: você não está comprando um modelo pequeno e medíocre para tarefas descartáveis. Está comprando algo que rivaliza com o topo, mas que cobra por token de saída menos do que a OpenAI cobra pelo o3. O contexto de 200 mil tokens e a modalidade texto+imagem+arquivo → texto ampliam o leque de uso, e o índice de codificação de 43,89 mostra que ele aguenta programação de verdade, não só classificação de e-mail.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-haiku-4.5 |
| Criador | anthropic |
| Preço de entrada | US$ 1.00 / M tokens |
| Preço de saída | US$ 5.00 / M tokens |
| Janela de contexto | 200k |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.100 / M (90% de desconto) |
| Índice de inteligência (AA) | 29.9 |
| Índice de código | 43.9 |
| Índice agêntico | 16.5 |
| Pesos | fechados |
| Velocidade de saída | 90 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
A conta, detalhe por detalhe
O preço de entrada do Haiku 4.5 é US$ 1 por milhão de tokens — o mesmo que o do o3 da OpenAI, e mais caro que o do gpt-oss-120b (US$ 0,17 por milhão de saída, com entrada gratuita). A diferença está na saída: US$ 5 contra US$ 8 do o3. Se o seu caso de uso gera muito texto (resumos longos, geração de código, agentes), essa diferença pesa. Se você só classifica ou faz embedding, o Haiku 4.5 não é a melhor escolha — o gpt-oss-120b entrega inteligência menor (24,13) por uma fração do custo.
A Anthropic também ofereceu uma versão batch no mesmo lançamento, com metade do preço: US$ 0,50 de entrada e US$ 2,50 de saída por milhão de tokens. É a opção para quem pode esperar algumas horas pelo processamento e quer cortar a fatura.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Haiku 4.5 (batch) | 0.5 | 2.5 | 200k |
Para quem vale, e para quem não muda nada
Vale para você se: roda agentes em produção, gera muito texto por chamada, ou quer um modelo com raciocínio ativado (o campo reasoning está como true) sem pagar US$ 8 por milhão de saída. Vale especialmente se você já estava no ecossistema Claude e considerava migrar para o o3 por causa da inteligência — agora a diferença de IQ é de 1,2 ponto, e a diferença de preço, de US$ 3 por milhão.
Não muda nada para você se: usa modelos abertos self-hosted e não paga API por token — o Haiku 4.5 não tem pesos abertos (open_weights: false), então não substitui um Qwen3 Next 80B A3B Thinking rodando na sua própria GPU. Também não muda nada se você precisa do topo absoluto em inteligência: o o3 segue na frente por uma margem pequena, e o preço reflete isso.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Haiku 4.5 (o novo) | 29.9 | 1 | 5 | 200k |
| o3 | 31.1 | 2 | 8 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Qwen3 Next 80B A3B Thinking | 16.9 | 0.15 | 1.2 | 262k |
O que fazer com isso hoje
Se você está rodando agente ou pipeline de código com Claude Sonnet 4 hoje, teste o Haiku 4.5 no mesmo prompt e meça a diferença de qualidade. Pelos números do índice, a Anthropic promete paridade — e a conta cai um terço. Se está decidindo entre OpenAI e Anthropic para um projeto novo, a equação ficou mais apertada: o Haiku 4.5 entrega 96% da inteligência do o3 por 62% do preço de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Uma ressalva honesta: o índice de inteligência da Artificial Analysis é uma fotografia de hoje. Não há série histórica aqui, então não dá para afirmar que o Haiku "subiu" ou "disparou" — só que ele está onde está nesta data. O catálogo também é um piso: os 258 modelos listados são os que continuam disponíveis; modelos removidos depois do lançamento não aparecem.
Se você roda agente ou geração de código na API da Anthropic, vale testar o Haiku 4.5 no lugar do Sonnet 4 antes de renovar o contrato — a conta de saída cai um terço com paridade de inteligência.
Perguntas frequentes
Quanto custa o Claude Haiku 4.5?
US$ 1 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída. A versão batch, lançada no mesmo dia, sai por US$ 0,50 e US$ 2,50 respectivamente.
Claude Haiku 4.5 é melhor que o OpenAI o3?
Não. Pelo índice de inteligência da Artificial Analysis, o o3 marca 31,10 e o Haiku 4.5 marca 29,89 — uma diferença pequena, com o o3 ainda na frente. A vantagem do Haiku está no preço: US$ 5 contra US$ 8 por milhão de tokens de saída.
Claude Haiku 4.5 tem pesos abertos?
Não. O campo `open_weights` está como false, então o modelo só roda via API da Anthropic. Se você precisa de pesos abertos para self-host, a alternativa no mesmo nível de preço é o gpt-oss-120b da OpenAI, embora com inteligência menor.