Grok 4.1 Fast custa 16 vezes menos que o3 por token de saída
xAI entra no catálogo com modelo agente a US$ 0,50/M de saída e 2M de contexto, mas o índice de inteligência ainda não foi medido
US$ 8 contra US$ 0,50 — a conta que mudou de lado
Em um dia em que o o3 da OpenAI cobra US$ 8 por milhão de tokens de saída e lidera o índice de inteligência do catálogo, a xAI entrou pela porta do preço. O Grok 4.1 Fast apareceu hoje a US$ 0,50 — dezesseis vezes menos que o o3 pelo mesmo token.
| Campo | Valor |
|---|---|
| Identificador | x-ai/grok-4.1-fast |
| Criador | x-ai |
| Preço de entrada | US$ 0.200 / M tokens |
| Preço de saída | US$ 0.500 / M tokens |
| Janela de contexto | 2M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.050 / M (75% de desconto) |
O que está na caixa — e o que ainda não
A ficha entrega três coisas em conjunto. Janela de contexto de 2 milhões de tokens. Modalidade text+image+file→text — entra imagem e arquivo, sai só texto. E o posicionamento da própria xAI: melhor modelo da casa para chamada de ferramentas em fluxo agente, com casos de uso declarados em suporte ao cliente e pesquisa profunda. O cache de US$ 0,05 por milhão é o detalhe que muda a conta quando o seu pipeline reusa o mesmo prompt o dia todo.
Agora, o que ninguém quer ouvir: o índice de inteligência do Grok 4.1 Fast não consta no catálogo. Pode ser que ainda não foi medido, pode ser que a xAI não publicou. Comprar por capacidade sem ter o número é assinar contrato sem ler a cláusula de multa.
O preço dentro do campo de batalha
Para dimensionar US$ 0,50/M, basta olhar quem está na faixa de cima. O o3 cobra US$ 8 e tem IQ de 31,096. O Claude Haiku 4.5 sai por US$ 5, com IQ de 29,892. O Grok 4.1 Fast entra 16 vezes mais barato que o o3 e 10 vezes mais barato que o Haiku 4.5 — no mesmo segmento de uso, em tese.
Do outro lado, há o gpt-oss-120b da OpenAI, modelo aberto a US$ 0,17/M. É mais barato, sim, mas é outra conversa: open weights, hospedagem por sua conta, e IQ medido em 24,126.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Grok 4.1 Fast (o novo) | — | 0.2 | 0.5 | 2M |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
Para quem vale — e para quem não muda absolutamente nada
Vale se o seu projeto é fluxo agente, atendimento ao cliente com contexto longo ou pesquisa profunda, e o que dói na fatura é o volume de tokens que sai do modelo. A combinação de preço baixo, cache de US$ 0,05/M e 2 milhões de contexto foi desenhada exatamente para esse perfil.
Não muda nada se você precisa do modelo mais inteligente do catálogo — esse trono segue com o o3. E não muda nada se a sua tarefa cabe em 8 mil tokens, porque você vai pagar por capacidade que não vai usar.
O tabuleiro em 19 de novembro
O catálogo soma 277 modelos hoje, vindos de 42 criadores. Nos últimos 30 dias, 16 modelos novos entraram. O Grok 4.1 Fast chega como peça de artilharia de preço no segmento de agentes, sem a coroa de inteligência no índice público. Canivete, não bisturi.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
A pergunta que fica é direta: qual é a dor que pesa mais na sua fatura — o volume de tokens que sai, ou a margem de erro que o seu produto aguenta?
Se o seu gargalo é o volume de tokens de saída em fluxo agente, o Grok 4.1 Fast entra como opção de baixo custo — mas valide o resultado antes de trocar um modelo com inteligência medida.
Perguntas frequentes
Quanto custa o Grok 4.1 Fast por milhão de tokens?
US$ 0,20 para entrada, US$ 0,50 para saída e US$ 0,05 para cache, segundo o catálogo de 19 de novembro de 2025.
O Grok 4.1 Fast é mais inteligente que o o3?
O catálogo não publicou o índice de inteligência do Grok 4.1 Fast. Sem essa medição, não há como compará-lo com o o3, que lidera o ranking com 31,096.
Para que tipo de tarefa o Grok 4.1 Fast foi feito?
A xAI posiciona o modelo para fluxos agentes com chamada de ferramentas, citando suporte ao cliente e pesquisa profunda como casos de uso, com janela de 2 milhões de tokens.