IBM lança Granite 4.0 Micro por US$ 0,11/milhão com IQ de 1,95
Modelo de 3 bilhões de parâmetros e pesos abertos chega barato, mas entra no catálogo entre os menores índices de inteligência publicados.
US$ 0,11 por milhão de tokens. E o IQ em 1,95.
A IBM colocou hoje no catálogo o Granite 4.0 Micro cobrando US$ 0,112 por milhão de tokens de saída — e US$ 0,017 por milhão de entrada. É dos preços mais baixos da lista atual. Só que o índice de inteligênciaArtificial Analysis registra 1,952: o mais baixo entre os modelos com nota publicada no catálogo. Para efeito de comparação, o OpenAI o3, que lidera o ranking de hoje, está em 31,096 — quase 16 vezes mais.
O que a IBM está vendendo (e o que não está)
A ficha diz o seguinte: 3 bilhões de parâmetros, pesos abertos, família Granite 4, ajuste para contexto longo (131 mil tokens). O texto de descrição enfatiza a herança da série e o porte enxuto. O que o card não entrega — e isso é parte do argumento de venda — são notas de raciocínio, coding e agentic. Todas vêm como não publicadas no catálogo. A IBM não está colocando um cérebro novo na prateleira. Está colocando um modelo pequeno, aberto e barato que cabe em qualquer pipeline de baixo risco.
Como ele se compara com o que já existia
O catálogo de hoje tem mais de 261 modelos listados, vindos de 41 criadores. Trinta e um deles entraram nos últimos 30 dias — ou seja, a prateleira está se mexendo rápido. O rival natural por preço e abertura é o OpenAI gpt-oss-120b, que sai a US$ 0,17 por milhão de tokens de saída e marca IQ 24,126 — doze vezes a inteligência do Granite Micro por 50% a mais no token.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Granite 4.0 Micro (o novo) | 2.0 | 0.017 | 0.112 | 131k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
No topo da régua, o Claude Haiku 4.5 (IQ 29,892, US$ 5/milhão) e o o3 (IQ 31,096, US$ 8/milhão) seguem como referência para qualquer trabalho que exija raciocínio de verdade. Nenhum dos dois compete com o Granite Micro em preço — e nenhum dos dois deveria estar no mesmo caderno de comparação.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Para quem esse modelo faz sentido
Se a sua carga é classificação simples em alto volume, extração de campos, rotulagem em fila ou qualquer pipeline estreito em que o modelo só precise ser suficiente e não brilhante, o cálculo pode fechar. Os US$ 0,017 por milhão de entrada, os pesos abertos e os 3 bilhões de parâmetros formam um pacote fácil de auto-hospedar e de testar sem licença. É candidato a rodar em borda, em jobs agendados, em filas de alto throughput — não a ser o cérebro central do seu produto.
Para quem não muda nada
Se a tarefa envolve raciocínio multi-etapa, código não trivial, planejamento de agente ou qualquer fluxo que dependa do que o índice costuma capturar, o Granite Micro não é o que estava faltando no seu stack. A diferença de centavos por milhão de tokens entre ele e alternativas com 8x ou 12x mais inteligência raramente compensa uma queda de qualidade tão grande. Você gasta menos no token e gasta mais depurando saída.
O que fazer com isso hoje
Antes de adicionar o Granite 4.0 Micro à rotação, rode uma amostra do seu caso real e compare lado a lado com o gpt-oss-120b. Se a diferença de qualidade não destruir o pipeline, mantenha o que já está — o 120b entrega mais inteligência pelo mesmo dinheiro. O ganho real do Granite aparece quando você soma a possibilidade de hospedar os pesos na sua infraestrutura. Aí a conta deixa de ser só preço do token e vira preço do token mais custo de manter o modelo rodando, e os 3 bilhões de parâmetros passam a ser vantagem concreta em vez de marketing.
Para a maioria dos casos o ganho real do Granite 4.0 Micro só aparece quando a auto-hospedagem entra na conta — para o resto, alternativas como o gpt-oss-120b entregam até 12 vezes mais inteligência por centavos a mais por milhão de tokens.
Perguntas frequentes
Quanto custa o Granite 4.0 Micro?
US$ 0,017 por milhão de tokens de entrada e US$ 0,112 por milhão de tokens de saída, segundo o catálogo publicado em 20 de outubro de 2025. O preço de cache não foi divulgado.
O Granite 4.0 Micro tem pesos abertos?
Sim. A ficha indica pesos abertos, o que permite hospedar, modificar e redistribuir o modelo sem licença da IBM. Os 3 bilhões de parâmetros cabem em hardware modesto para inferência.
Vale trocar o gpt-oss-120b pelo Granite Micro?
Para a maioria dos casos, não. O gpt-oss-120b custa US$ 0,17 por milhão de tokens de saída e marca IQ 24,126 — quase 12 vezes mais inteligência por uma diferença pequena de preço. O Granite Micro só compensa quando a auto-hospedagem entra na conta.