FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.4 Mini custa um terço do Codex — e o catálogo não cravou IQ

Lançado em 17 de março, o modelo mini da OpenAI tem preço, contexto e cache publicados, mas ainda não tem nota de inteligência. O que isso muda para quem escolhe modelo pela fatura.

Redação FalaVIP IA 4 min de leitura
US$ 4,50por milhão de tokens de saída
US$ 0,075por milhão de tokens em cache
11 diasdesde o lançamento (17 de março de 2026)

A conta antes da inteligência

O release diz que o GPT-5.4 Mini traz "as capacidades principais do GPT-5.4 para um modelo menor, mais rápido, otimizado para alto volume". Bonito no papel. Só que, onze dias depois do lançamento em 17 de março, o catálogo público de modelos ainda não cravou um índice de inteligência para ele. O campo IQ está em branco.

Para quem escolhe modelo pela régua IQ/milhão de tokens, isso muda a leitura. Você passa a olhar preço, contexto e descrição de marketing — e a torcer para que o benchmark apareça logo.

Ficha técnica — GPT-5.4 Mini
CampoValor
Identificadoropenai/gpt-5.4-mini
Criadoropenai
Preço de entradaUS$ 0.750 / M tokens
Preço de saídaUS$ 4.50 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.075 / M (90% de desconto)

O preço na ponta do lápis

A OpenAI publicou três números que importam para a fatura:

  • Entrada: US$ 0,75 por milhão de tokens
  • Saída: US$ 4,50 por milhão de tokens
  • Cache de leitura: US$ 0,075 por milhão de tokens

A entrada aceita texto, imagem e arquivo; a saída é só texto. Janela de contexto é 400 mil tokens — generosa para RAG e few-shot com material longo. Corte de conhecimento: agosto de 2025.

O detalhe que manda no volume é o cache. US$ 0,075 é 10% do preço de entrada. Pense como uma assinatura mensal de streaming: você paga uma vez pelo catálogo e assiste o que quiser sem pagar de novo. Quem repete o mesmo bloco de contexto — prompt de sistema longo, exemplos fixos, base de RAG — consegue rodar o mesmo pedido por uma fração do custo real. Em chamadas longas com prefixo estável, é onde mora a economia.

Onde ele senta no tabuleiro

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 375 modelos disponíveis no catálogo nesta data.

O topo do catálogo hoje tem dois modelos acima de IQ 45: Google Gemini 3.1 Pro Preview (47,7, US$ 12 de saída) e o GPT-5.3-Codex da própria OpenAI (45,5, US$ 14 de saída). O GPT-5.4 Mini cobra US$ 4,50 de saída — pouco menos de um terço do Codex e pouco mais de um terço do Gemini 3.1 Pro. Em outras palavras, ele senta num preço intermediário entre o teto absoluto e o andar de baixo.

Abaixo dele, na faixa de US$ 2 a US$ 2,34 por milhão de saída, ficam Xiaomi MiMo-V2-Omni (IQ 35,8) e Qwen3.5 397B A17B (IQ 34,2). São mais baratos, mas num patamar de IQ visivelmente menor — quase dez pontos abaixo do topo. Anthropic Claude Sonnet 4.6 (IQ 35,1) cobra US$ 15 de saída — o oposto do Mini: caro e mais simples.

A pergunta que fica: onde o 5.4 Mini entra nessa régua? Sem IQ publicado, não dá para cravar se ele conversa com o teto de IQ 45 ou se fica mais perto do andar dos 35.

O buraco do benchmark

O catálogo tem hoje 375 modelos ativos, de 54 criadores, com 25 lançamentos nos últimos 30 dias. O índice de inteligência é atualizado de forma contínua — e nesta data ele ainda não tem leitura para o 5.4 Mini.

Isso não é detalhe menor. Para quem decide comparando IQ por dólar, o Mini virou uma caixa-preta de capacidade. A descrição diz "forte desempenho em raciocínio, código e fluxos agênticos", mas "forte" sem número é argumento de release, não de decisão. O rótulo "mini" sugere perda de capacidade, e o tamanho da perda é justamente o que o índice mediria.

Se o seu fluxo depende de raciocínio pesado, codificação longa ou planejamento agêntico, esperar o índice cair publicado é razoável. Se você precisa de um modelo competente para classificar, resumir, extrair ou responder a volume, o preço sozinho já coloca ele na mesa — faltando a régua do catálogo, vale construir a sua.

Para quem vale — e para quem não vale

Vale olhar de perto se você roda:

  • Pipelines com prompts repetidos — o cache a US$ 0,075 muda a equação
  • Classificação, sumarização ou extração em massa de documentos
  • Fluxos que já usam GPT-5.4 e querem cortar a fatura em chamadas de menor risco
  • Cargas com entrada multimodal (texto, imagem, arquivo) e saída em texto curto

Não muda nada se você:

  • Precisa do melhor raciocínio absoluto publicado — Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem na frente com IQ acima de 45
  • Quer o mais barato absoluto e aceita capacidade menor — Xiaomi e Qwen entregam IQ próximo dos 35 por quase metade do preço
  • Precisa gerar multimodal na saída — o 5.4 Mini só devolve texto

Se você já paga GPT-5.4 em produção, rode uma suíte interna comparando o Mini no mesmo prompt e meça qualidade por centavos gastos. O preço sugere que ele aguenta volume; a incógnita é até onde aguenta sem perder qualidade. Até o catálogo publicar IQ, a régua certa é a sua — não a do release.

Em uma frase

Se você já roda GPT-5.4 em volume, vale testar o Mini em prompts repetidos para explorar o cache a US$ 0,075 — mas espere o IQ publicado antes de migrar cargas que dependem de raciocínio pesado.

Perguntas frequentes

GPT-5.4 Mini tem IQ publicado?

Não. Onze dias depois do lançamento, o catálogo ainda não cravou índice de inteligência para o modelo. O campo IQ aparece em branco, então qualquer comparação direta com GPT-5.3-Codex ou Gemini 3.1 Pro só dá para fazer pelo preço.

GPT-5.4 Mini vale a pena para produção?

Depende do tipo de chamada. Para volume alto com prompts repetidos, o cache a US$ 0,075 muda a conta. Para raciocínio pesado, espere o benchmark ou compare internamente antes de migrar a stack inteira.

Qual a diferença entre GPT-5.4 Mini e GPT-5.3-Codex?

O Codex está acima de IQ 45 e custa US$ 14 por milhão de saída; o Mini custa US$ 4,50, mas ainda não tem IQ publicado. Em outras palavras, o Mini é mais barato, mas você está comprando capacidade no escuro até o índice sair.

Leia também