GPT-5.4 Mini custa um terço do Codex — e o catálogo não cravou IQ
Lançado em 17 de março, o modelo mini da OpenAI tem preço, contexto e cache publicados, mas ainda não tem nota de inteligência. O que isso muda para quem escolhe modelo pela fatura.
A conta antes da inteligência
O release diz que o GPT-5.4 Mini traz "as capacidades principais do GPT-5.4 para um modelo menor, mais rápido, otimizado para alto volume". Bonito no papel. Só que, onze dias depois do lançamento em 17 de março, o catálogo público de modelos ainda não cravou um índice de inteligência para ele. O campo IQ está em branco.
Para quem escolhe modelo pela régua IQ/milhão de tokens, isso muda a leitura. Você passa a olhar preço, contexto e descrição de marketing — e a torcer para que o benchmark apareça logo.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5.4-mini |
| Criador | openai |
| Preço de entrada | US$ 0.750 / M tokens |
| Preço de saída | US$ 4.50 / M tokens |
| Janela de contexto | 400k |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.075 / M (90% de desconto) |
O preço na ponta do lápis
A OpenAI publicou três números que importam para a fatura:
- Entrada: US$ 0,75 por milhão de tokens
- Saída: US$ 4,50 por milhão de tokens
- Cache de leitura: US$ 0,075 por milhão de tokens
A entrada aceita texto, imagem e arquivo; a saída é só texto. Janela de contexto é 400 mil tokens — generosa para RAG e few-shot com material longo. Corte de conhecimento: agosto de 2025.
O detalhe que manda no volume é o cache. US$ 0,075 é 10% do preço de entrada. Pense como uma assinatura mensal de streaming: você paga uma vez pelo catálogo e assiste o que quiser sem pagar de novo. Quem repete o mesmo bloco de contexto — prompt de sistema longo, exemplos fixos, base de RAG — consegue rodar o mesmo pedido por uma fração do custo real. Em chamadas longas com prefixo estável, é onde mora a economia.
Onde ele senta no tabuleiro
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O topo do catálogo hoje tem dois modelos acima de IQ 45: Google Gemini 3.1 Pro Preview (47,7, US$ 12 de saída) e o GPT-5.3-Codex da própria OpenAI (45,5, US$ 14 de saída). O GPT-5.4 Mini cobra US$ 4,50 de saída — pouco menos de um terço do Codex e pouco mais de um terço do Gemini 3.1 Pro. Em outras palavras, ele senta num preço intermediário entre o teto absoluto e o andar de baixo.
Abaixo dele, na faixa de US$ 2 a US$ 2,34 por milhão de saída, ficam Xiaomi MiMo-V2-Omni (IQ 35,8) e Qwen3.5 397B A17B (IQ 34,2). São mais baratos, mas num patamar de IQ visivelmente menor — quase dez pontos abaixo do topo. Anthropic Claude Sonnet 4.6 (IQ 35,1) cobra US$ 15 de saída — o oposto do Mini: caro e mais simples.
A pergunta que fica: onde o 5.4 Mini entra nessa régua? Sem IQ publicado, não dá para cravar se ele conversa com o teto de IQ 45 ou se fica mais perto do andar dos 35.
O buraco do benchmark
O catálogo tem hoje 375 modelos ativos, de 54 criadores, com 25 lançamentos nos últimos 30 dias. O índice de inteligência é atualizado de forma contínua — e nesta data ele ainda não tem leitura para o 5.4 Mini.
Isso não é detalhe menor. Para quem decide comparando IQ por dólar, o Mini virou uma caixa-preta de capacidade. A descrição diz "forte desempenho em raciocínio, código e fluxos agênticos", mas "forte" sem número é argumento de release, não de decisão. O rótulo "mini" sugere perda de capacidade, e o tamanho da perda é justamente o que o índice mediria.
Se o seu fluxo depende de raciocínio pesado, codificação longa ou planejamento agêntico, esperar o índice cair publicado é razoável. Se você precisa de um modelo competente para classificar, resumir, extrair ou responder a volume, o preço sozinho já coloca ele na mesa — faltando a régua do catálogo, vale construir a sua.
Para quem vale — e para quem não vale
Vale olhar de perto se você roda:
- Pipelines com prompts repetidos — o cache a US$ 0,075 muda a equação
- Classificação, sumarização ou extração em massa de documentos
- Fluxos que já usam GPT-5.4 e querem cortar a fatura em chamadas de menor risco
- Cargas com entrada multimodal (texto, imagem, arquivo) e saída em texto curto
Não muda nada se você:
- Precisa do melhor raciocínio absoluto publicado — Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem na frente com IQ acima de 45
- Quer o mais barato absoluto e aceita capacidade menor — Xiaomi e Qwen entregam IQ próximo dos 35 por quase metade do preço
- Precisa gerar multimodal na saída — o 5.4 Mini só devolve texto
Se você já paga GPT-5.4 em produção, rode uma suíte interna comparando o Mini no mesmo prompt e meça qualidade por centavos gastos. O preço sugere que ele aguenta volume; a incógnita é até onde aguenta sem perder qualidade. Até o catálogo publicar IQ, a régua certa é a sua — não a do release.
Se você já roda GPT-5.4 em volume, vale testar o Mini em prompts repetidos para explorar o cache a US$ 0,075 — mas espere o IQ publicado antes de migrar cargas que dependem de raciocínio pesado.
Perguntas frequentes
GPT-5.4 Mini tem IQ publicado?
Não. Onze dias depois do lançamento, o catálogo ainda não cravou índice de inteligência para o modelo. O campo IQ aparece em branco, então qualquer comparação direta com GPT-5.3-Codex ou Gemini 3.1 Pro só dá para fazer pelo preço.
GPT-5.4 Mini vale a pena para produção?
Depende do tipo de chamada. Para volume alto com prompts repetidos, o cache a US$ 0,075 muda a conta. Para raciocínio pesado, espere o benchmark ou compare internamente antes de migrar a stack inteira.
Qual a diferença entre GPT-5.4 Mini e GPT-5.3-Codex?
O Codex está acima de IQ 45 e custa US$ 14 por milhão de saída; o Mini custa US$ 4,50, mas ainda não tem IQ publicado. Em outras palavras, o Mini é mais barato, mas você está comprando capacidade no escuro até o índice sair.