FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

IBM lança Granite 4.0 Micro por US$ 0,11/milhão com IQ de 1,95

Modelo de 3 bilhões de parâmetros e pesos abertos chega barato, mas entra no catálogo entre os menores índices de inteligência publicados.

Redação FalaVIP IA 3 min de leitura
US$ 0,112por milhão de tokens de saída
US$ 0,017por milhão de tokens de entrada
1,952índice de inteligência Artificial Analysis

US$ 0,11 por milhão de tokens. E o IQ em 1,95.

A IBM colocou hoje no catálogo o Granite 4.0 Micro cobrando US$ 0,112 por milhão de tokens de saída — e US$ 0,017 por milhão de entrada. É dos preços mais baixos da lista atual. Só que o índice de inteligênciaArtificial Analysis registra 1,952: o mais baixo entre os modelos com nota publicada no catálogo. Para efeito de comparação, o OpenAI o3, que lidera o ranking de hoje, está em 31,096 — quase 16 vezes mais.

Índice de inteligência (Artificial Analysis)
Granite 4.0 Micro2o331,1Claude Haiku 4.529,9gpt-oss-120b24,1índice
Fonte: Artificial Analysis

O que a IBM está vendendo (e o que não está)

A ficha diz o seguinte: 3 bilhões de parâmetros, pesos abertos, família Granite 4, ajuste para contexto longo (131 mil tokens). O texto de descrição enfatiza a herança da série e o porte enxuto. O que o card não entrega — e isso é parte do argumento de venda — são notas de raciocínio, coding e agentic. Todas vêm como não publicadas no catálogo. A IBM não está colocando um cérebro novo na prateleira. Está colocando um modelo pequeno, aberto e barato que cabe em qualquer pipeline de baixo risco.

Como ele se compara com o que já existia

O catálogo de hoje tem mais de 261 modelos listados, vindos de 41 criadores. Trinta e um deles entraram nos últimos 30 dias — ou seja, a prateleira está se mexendo rápido. O rival natural por preço e abertura é o OpenAI gpt-oss-120b, que sai a US$ 0,17 por milhão de tokens de saída e marca IQ 24,126 — doze vezes a inteligência do Granite Micro por 50% a mais no token.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Granite 4.0 Micro (o novo)2.00.0170.112131k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

No topo da régua, o Claude Haiku 4.5 (IQ 29,892, US$ 5/milhão) e o o3 (IQ 31,096, US$ 8/milhão) seguem como referência para qualquer trabalho que exija raciocínio de verdade. Nenhum dos dois compete com o Granite Micro em preço — e nenhum dos dois deveria estar no mesmo caderno de comparação.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 261 modelos disponíveis no catálogo nesta data.

Para quem esse modelo faz sentido

Se a sua carga é classificação simples em alto volume, extração de campos, rotulagem em fila ou qualquer pipeline estreito em que o modelo só precise ser suficiente e não brilhante, o cálculo pode fechar. Os US$ 0,017 por milhão de entrada, os pesos abertos e os 3 bilhões de parâmetros formam um pacote fácil de auto-hospedar e de testar sem licença. É candidato a rodar em borda, em jobs agendados, em filas de alto throughput — não a ser o cérebro central do seu produto.

Para quem não muda nada

Se a tarefa envolve raciocínio multi-etapa, código não trivial, planejamento de agente ou qualquer fluxo que dependa do que o índice costuma capturar, o Granite Micro não é o que estava faltando no seu stack. A diferença de centavos por milhão de tokens entre ele e alternativas com 8x ou 12x mais inteligência raramente compensa uma queda de qualidade tão grande. Você gasta menos no token e gasta mais depurando saída.

O que fazer com isso hoje

Antes de adicionar o Granite 4.0 Micro à rotação, rode uma amostra do seu caso real e compare lado a lado com o gpt-oss-120b. Se a diferença de qualidade não destruir o pipeline, mantenha o que já está — o 120b entrega mais inteligência pelo mesmo dinheiro. O ganho real do Granite aparece quando você soma a possibilidade de hospedar os pesos na sua infraestrutura. Aí a conta deixa de ser só preço do token e vira preço do token mais custo de manter o modelo rodando, e os 3 bilhões de parâmetros passam a ser vantagem concreta em vez de marketing.

Em uma frase

Para a maioria dos casos o ganho real do Granite 4.0 Micro só aparece quando a auto-hospedagem entra na conta — para o resto, alternativas como o gpt-oss-120b entregam até 12 vezes mais inteligência por centavos a mais por milhão de tokens.

Perguntas frequentes

Quanto custa o Granite 4.0 Micro?

US$ 0,017 por milhão de tokens de entrada e US$ 0,112 por milhão de tokens de saída, segundo o catálogo publicado em 20 de outubro de 2025. O preço de cache não foi divulgado.

O Granite 4.0 Micro tem pesos abertos?

Sim. A ficha indica pesos abertos, o que permite hospedar, modificar e redistribuir o modelo sem licença da IBM. Os 3 bilhões de parâmetros cabem em hardware modesto para inferência.

Vale trocar o gpt-oss-120b pelo Granite Micro?

Para a maioria dos casos, não. O gpt-oss-120b custa US$ 0,17 por milhão de tokens de saída e marca IQ 24,126 — quase 12 vezes mais inteligência por uma diferença pequena de preço. O Granite Micro só compensa quando a auto-hospedagem entra na conta.