FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Grok 4.20 cobra US$ 4,40 por milhão de saída — vale sem nota de IQ?

SpaceXAI promete o modelo mais rápido e menos alucinador do mercado, mas o catálogo ainda não publicou índice de inteligência. Veja contra quem ele compete e quando não compensa.

Redação FalaVIP IA 3 min de leitura
US$ 2,50por milhão de tokens de saída
US$ 1,25por milhão de tokens de entrada
US$ 0,20por milhão de tokens em cache

Onze dias após o lançamento, o Grok 4.20 ainda não tem nota de inteligência publicada no catálogo. Em um mercado onde o topo já está medido — Gemini 3.1 Pro Preview em 47,7, GPT-5.3-Codex em 45,5, Claude Sonnet 4.6 em 35,1 — entrar sem índice é entrar vendendo velocidade e preço. É justo perguntar: vale a conta?

O que a SpaceXAI está vendendo

O release descreve o Grok 4.20 como um modelo de raciocínio com a menor taxa de alucinação do mercado, aderência rígida a prompts e chamadas de ferramentas agentic rápidas. Janela de contexto de 2 milhões de tokens, multimodalidade texto+imagem+arquivo, corte de conhecimento em setembro de 2025. É um pacote ambicioso — mas ambição no release não é benchmark.

Ficha técnica — Grok 4.20
CampoValor
Identificadorx-ai/grok-4.20
Criadorx-ai
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 2.50 / M tokens
Janela de contexto2M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.200 / M (84% de desconto)

O detalhe que importa para quem paga a conta está nos números: US$ 1,25 por milhão de entrada, US$ 2,50 por milhão de saída, US$ 0,20 por milhão em cache. Sem tier gratuito. É mais barato na entrada do que o Gemini 3.1 Pro Preview (US$ 12 de saída) e o GPT-5.3-Codex (US$ 14), mas essa comparação direta é desonesta — você está colocando um carro sem teste de crash contra dois que já passaram.

O buraco no meio da ficha

Quatro campos críticos estão vazios: IQ, coding, agentic, blended. Sem essas notas, o Grok 4.20 é um modelo que pede para ser comprado no escuro. Em abril de 2026, com 390 modelos no catálogo e 54 criadores, o leitor tem alternativas com benchmark. O catálogo não publicou preço para o Sonnet 4.6 nesta data — então a comparação direta por dólar sai comprometida, mas a comparação por capacidade, não.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 390 modelos disponíveis no catálogo nesta data.

A diferença entre o topo medido e o Grok 4.20 é grande. Gemini 3.1 Pro Preview lidera com IQ 47,7 a US$ 12 de saída. GPT-5.3-Codex vem logo atrás em 45,5 a US$ 14. Mesmo o Claude Sonnet 4.6, com IQ 35,1, tem nota pública. O Grok 4.20 tem um argumento de velocidade e um de preço de entrada — só.

Para quem vale

Se você está construindo um agente que faz muitas chamadas curtas e precisa de baixa latência, o posicionamento do Grok 4.20 faz sentido: chamadas de ferramenta rápidas, contexto gigante de 2M tokens, cache barato a US$ 0,20. O preço de entrada a US$ 1,25 é competitivo, e o cache é o mais barato entre os modelos de topo com preço publicado. Para um pipeline agentic que reusa prompts longos repetidamente, esse cache pode ser o argumento decisivo.

Se você precisa de raciocínio profundo em matemática, código ou planejamento multi-etapa, espere o benchmark. A descrição menciona aderência a prompt e baixa alucinação, mas não publica números. Em produção, sem nota, você vira o testador beta.

Para quem não muda nada

Se você já roda Sonnet 4.6 ou GPT-5.3-Codex em produção com prompts estáveis e latência aceitável, trocar pelo Grok 4.20 hoje é um experimento, não uma otimização. A economia potencial existe no papel, mas o risco de regressão de qualidade sem métrica pública é real. E se o seu caso de uso é multimodal simples ou geração de texto curto, qualquer modelo de fronteira serve — o diferencial do Grok 4.20 não aparece.

O que fazer com isso

Trate o Grok 4.20 como candidato a teste A/B, não como substituição. Rode seu próprio benchmark interno no seu workload — extração de dados, tool calling, geração estruturada — antes de migrar volume. O preço de entrada e o cache são reais; a promessa de "industry-leading speed" precisa de medição no seu stack. Se a latência cair 30% e a qualidade se mantiver, a conta fecha. Se a qualidade oscilar, você trocou economia no papel por retrabalho.

Em uma frase

Compre o Grok 4.20 só depois de medir no seu workload — o preço de entrada e o cache são reais, mas o índice de inteligência ainda não foi publicado.

Perguntas frequentes

Quanto custa o Grok 4.20 na API?

US$ 1,25 por milhão de tokens de entrada, US$ 2,50 por milhão de tokens de saída e US$ 0,20 por milhão de tokens em cache. Não há tier gratuito publicado no catálogo nesta data.

O Grok 4.20 tem benchmark de inteligência?

Não. Em 11 de abril de 2026, o catálogo ainda não publicou índice de IQ, notas de coding, agentic ou blended para o modelo. Os campos estão vazios na ficha.

Grok 4.20 é melhor que GPT-5.3-Codex ou Gemini 3.1 Pro?

Sem nota de IQ publicada, não dá para afirmar. Gemini 3.1 Pro Preview lidera com IQ 47,7 e GPT-5.3-Codex vem em 45,5 — ambos com benchmark público. O argumento do Grok 4.20 hoje é preço de entrada e cache, não capacidade medida.

Leia também