FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.4 Mini batch: barato de verdade, mas sem nota de IQ

É o ponto mais barato da família GPT-5 — desde que você tope esperar horas pela resposta e decidir sem benchmark.

Redação FalaVIP IA 3 min de leitura
US$ 2,25por milhão de tokens de saída
US$ 0,0375por milhão de tokens em cache (10x mais barato que a entrada)
6,2 vezesmais barato que o GPT-5.3-Codex da própria OpenAI

O tabuleiro de preços em março de 2026

Mais de 375 modelos no catálogo hoje, 54 criadores diferentes, 27 lançamentos nos últimos 30 dias. No topo da régua de inteligência medida, só dois passam de IQ 45: o Gemini 3.1 Pro Preview, da Google, a US$ 12 por milhão de tokens de saída, e o GPT-5.3-Codex, da própria OpenAI, a US$ 14. Esses são os números de hoje, não os de quando esses modelos saíram.

Abaixo desse teto, a próxima faixa (IQ entre 34 e 36) já cai para US$ 2 a US$ 2,34 por milhão — Xiaomi MiMo-V2-Omni e Qwen3.5 397B A17B. É nesse segundo andar que o GPT-5.4 Mini batch aparece: US$ 2,25 por milhão de tokens de saída, US$ 0,375 de entrada e US$ 0,0375 em cache, com janela de contexto de 400 mil tokens e corte de conhecimento em agosto de 2025.

Ficha técnica — GPT-5.4 Mini (batch)
CampoValor
Identificadoropenai/gpt-5.4-mini:batch
Criadoropenai
Preço de entradaUS$ 0.375 / M tokens
Preço de saídaUS$ 2.25 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.037 / M (90% de desconto)

O que "batch" quer dizer e onde ele se encaixa

Batch é o modo em que sua chamada entra numa fila e volta sem compromisso de tempo real. É a mesma lógica de envio econômico de pacotes: você tolera esperar mais e paga menos. O preço de US$ 2,25 já é o do batch — não compare com o preço cheio do endpoint síncrono, que é outro número.

Na régua de hoje, o GPT-5.4 Mini batch sai por US$ 2,25 por milhão de saída. O GPT-5.3-Codex sai por US$ 14 — 6,2 vezes mais caro. Contra o Gemini 3.1 Pro Preview, são 5,3 vezes. Contra o Claude Sonnet 4.6, 6,7 vezes. Onde ele para de ser barato é na comparação com a faixa logo abaixo: o MiMo-V2-Omni está em US$ 2 e o Qwen3.5 397B A17B em US$ 2,34. Mas esses dois já têm nota de IQ medida (35,866 e 34,262, respectivamente). O GPT-5.4 Mini batch, dez dias depois do lançamento, ainda não.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 375 modelos disponíveis no catálogo nesta data.

O elefante na sala: sem benchmark público

Dez dias após o lançamento, o índice de inteligência do GPT-5.4 Mini batch segue em branco no catálogo. Não tem IQ, não tem nota de coding, não tem agentic, não tem blended. O que existe é a descrição da própria OpenAI — "core capabilities of GPT-5.4" — e a janela de contexto de 400 mil tokens.

Isso não é necessariamente ruim. O catálogo mede os modelos na medida em que eles aparecem nas filas de teste, e modelos novos entram em ritmo. Mas na hora de colocar na planilha, significa decidir no escuro sobre a qualidade real.

Para quem vale e para quem não muda nada

Se você roda lote grande de classificação, sumarização, extração de entidade ou tradução com prompt repetido e tolera esperar horas, o GPT-5.4 Mini batch entra na conta. O cache a US$ 0,0375 por milhão é onde ele brilha: para prompts com prefixo estável — system prompt grande, documentos reutilizados — o custo efetivo de input cai uma ordem de grandeza. Vale também para quem está migrando cargas do GPT-4o Mini ou do próprio GPT-5.3-Codex e quer um teste A/B barato antes de comprometer produção com a linha Mini.

Se você precisa de resposta síncrona — atendimento ao cliente, agente em tempo real, IDE com autocomplete — batch está fora por definição. Se você precisa do teto da classe em raciocínio, o limite hoje é Gemini 3.1 Pro Preview a US$ 12, e nenhum modelo Mini vai te entregar isso. E se a sua decisão depende de benchmark público e reprodutível, dez dias sem nota é cedo demais para comprometer orçamento.

A implicação prática é direta: trate o GPT-5.4 Mini batch como candidato a trabalho assíncrono de baixo risco, não como substituto do Codex ou do Gemini Pro. A diferença de até 6,7 vezes no preço existe — mas só faz sentido se a sua fila de tarefas já estava esperando horas mesmo.

Em uma frase

Use GPT-5.4 Mini batch para jobs assíncronos com prompt repetido e cache estável; se você precisa de resposta em tempo real, teto de raciocínio ou benchmark público, o modelo ainda não é a peça certa.

Perguntas frequentes

O GPT-5.4 Mini batch já tem nota de IQ?

Não. Dez dias depois do lançamento (27 de março de 2026), o catálogo ainda não publicou índice de inteligência, nem notas de coding ou agentic para o modelo. Isso não quer dizer que ele seja ruim — significa que você está decidindo no escuro até a medição aparecer.

Qual a diferença entre GPT-5.4 Mini e GPT-5.4 Mini batch?

É o mesmo modelo servido por endpoints diferentes. O batch processa de forma assíncrona — a chamada entra numa fila e retorna em horas, sem compromisso de latência. Em troca, o custo por token é menor do que no endpoint em tempo real.

Vale trocar o GPT-5.3-Codex pelo GPT-5.4 Mini batch?

Só se a sua carga tolerar esperar horas. Em troca da latência assíncrona, você paga cerca de 6 vezes menos por milhão de tokens de saída — mas perde o teto de IQ 45 do Codex e a previsibilidade de um modelo já medido.

Leia também