FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

GPT-5.5 sobe de nota em três variantes no mesmo dia e ninguém mexeu no preço

A OpenAI não lançou nada novo: a régua do Artificial Analysis se mexeu e três versões do GPT-5.5 ficaram mais inteligentes no papel — sem mudar o que você paga.

Redação FalaVIP IA 3 min de leitura
50,409novo IQ do GPT-5.5 (medium)
+3,264 pontossalto do GPT-5.5 medium na régua
US$ 11,25preço por milhão de tokens de saída, inalterado

Se você comparou o GPT-5.5 com o Gemini 3.1 Pro Preview na semana passada e fechou a planilha, preste atenção: a régua mudou debaixo da sua escolha. Hoje o Artificial Analysis recalibrou três variantes do GPT-5.5 — medium, low e a versão non-reasoning — e todas subiram de nota. Nenhum byte do modelo foi tocado. Nenhum centavo do preço foi mexido.

O que exatamente mudou

A versão medium, que costuma ser a que vaza para o mercado como "o GPT-5.5 de verdade", saltou de 47,145 para 50,409. São 3,264 pontos a mais na régua — o suficiente para cruzar, de uma vez, o limite simbólico dos 50. A variante low foi de 41,729 para 43,46. A non-reasoning, que historicamente patina mais longe do topo, subiu de 32,742 para 35,383.

Em todos os três casos o preço segue em US$ 11,25 por milhão de tokens de saída. Você está pagando o mesmo de ontem por um modelo que, na régua de hoje, vale mais.

Notas revisadas pelo Artificial Analysis
ModeloAntesDepoisDiferença
GPT-5.5 (medium)47.150.4+3.3
GPT-5.5 (Non-reasoning)32.735.4+2.6
GPT-5.5 (low)41.743.5+1.7

O que isso diz sobre a régua, não sobre o modelo

Antes de comemorar (ou reclamar), vale separar duas coisas que costumam se misturar nessas notícias. A primeira: o modelo em si não mudou. Não houve fine-tune, não houve nova versão de pesos, não houve mudança de arquitetura. A segunda: a régua do Artificial Analysis mudou. Quando o avaliador recalibra os testes, todos os modelos medidos nele se movem juntos — alguns sobem, outros descem, alguns ficam.

Hoje só três se moveram para cima, e os três são da OpenAI. Isso não quer dizer que a OpenAI ficou mais inteligente da noite para o dia. Quer dizer que, no recorte específico que o avaliador escolheu hoje, esses três modelos passaram a ser pontuados de forma mais generosa. A régua se mexeu; o terreno continua o mesmo.

Onde o GPT-5.5 medium fica no tabuleiro agora

Com 50,409, a variante medium do GPT-5.5 entra no mesmo clube do Claude Fable 5, da Anthropic, que lidera o catálogo com 62,073. Está acima do Gemini 3.1 Pro Preview (47,738), do Gemini 3.5 Flash (46,673) e do GPT-5.3-Codex (45,512). Está, também, acima do seu próprio irmão non-reasoning por 15 pontos — diferença grande, que confirma por que a OpenAI cobra caro na versão que raciocina.

Para efeito de comparação: o modelo mais barato do catálogo acima de IQ 45 hoje é o MiniMax M3, a US$ 1,20 por milhão de tokens de saída. O GPT-5.5 medium custa quase dez vezes isso. A pergunta que cabe é se os 5 pontos de IQ a mais justificam os quase dez dólares a mais por milhão — e essa conta é sua, não minha.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Para quem isso muda alguma coisa

Se você já roda GPT-5.5 em produção e pagava US$ 11,25 por milhão de saída, hoje você está rodando um modelo que, na régua de referência, pontua mais alto. Não muda a fatura, não muda a latência, não muda a integração. Muda a resposta para a pergunta "por que estou pagando esse preço?" — agora ela tem um número melhor do lado.

Se você estava comparando GPT-5.5 com Gemini 3.1 Pro Preview ou com Claude Fable 5 e quase fechou com a OpenAI, a reavaliação reforça o que você já tinha visto. Se estava quase descartando o GPT-5.5 em favor de uma alternativa mais barata, a régua de hoje joga contra esse corte.

Para quem nunca considerou o GPT-5.5 — porque o preço assusta e o IQ parecia médio —, a notícia de hoje tira um argumento, mas não o principal. O GPT-5.5 medium continua sendo um modelo premium. A régua subiu, o preço não.

O que fazer com isso na segunda-feira

Primeiro: não troque de modelo por causa de uma reavaliação isolada. Espere o próximo ciclo e veja se a nota se estabiliza onde está ou se oscila de novo. Segundo: se você roda GPT-5.5 medium em algum fluxo crítico, rode o mesmo prompt de antes e compare a saída de hoje com a de duas semanas atrás — a régua mudou, mas a resposta do modelo, essa sim, é a mesma. Terceiro: anote a data. Daqui a um mês, quando alguém perguntar "o GPT-5.5 medium é melhor que o Gemini 3.1 Pro Preview?", você vai querer saber de qual reavaliação está falando.

Em uma frase

Se você já paga US$ 11,25 por milhão no GPT-5.5 medium, hoje está levando um modelo que pontua mais na régua pelo mesmo preço — mas espere o próximo ciclo antes de reescrever qualquer planilha de comparação.

Perguntas frequentes

O GPT-5.5 ficou realmente mais inteligente?

Não. O modelo em si não mudou — foi a régua do Artificial Analysis que foi recalibrada. Os três variantes do GPT-5.5 foram reavaliados e ganharam pontos no índice de inteligência, sem qualquer alteração nos pesos ou no preço.

Quanto custa o GPT-5.5 medium agora?

US$ 11,25 por milhão de tokens de saída, mesmo valor de antes da reavaliação. A mudança foi apenas na nota de benchmark, não no preço de API.

Vale trocar do Gemini 3.1 Pro Preview para o GPT-5.5 medium depois dessa reavaliação?

Depende do seu caso. Com a nota atualizada, o GPT-5.5 medium (50,409) passou à frente do Gemini 3.1 Pro Preview (47,738) na régua, mas custa quase o mesmo que antes — e bem mais que alternativas como o MiniMax M3. A diferença de preço só se justifica se os 3 pontos de IQ a mais fizerem diferença real no seu fluxo.

Leia também

Benchmarks

GPT-5 perde nota e Llama 70B sobe na régua de julho

Artificial Analysis reavalia dois modelos no mesmo dia: o topo de linha da OpenAI cai quase 1,4 ponto de IQ, e o open-weight da Meta ganha fôlego.

Preços

OpenAI corta Sol pela metade e dobra Terra no mesmo dia

Movimento oposto dentro da mesma família deixa quem usa GPT-5.6 com escolha difícil entre preço e capacidade.

Benchmarks

Quatro modelos do catálogo tiveram a nota de benchmark revisada; um deles caiu quase 26%,Quatro notas de benchmark foram revisadas em um dia: o que muda na sua escolha,Quatro modelos reavaliados: Trinity Large Thinking perdeu 6,3 pontos de IQ,Reavaliação do dia derruba nota do Trinity Large Thinking em quase 26%,Quatro modelos reavaliados pelo Artificial Analysis em 22 de julho de 2026,Trinity Large Thinking cai de 24,5 para 18,2 na reavaliação do Artificial Analysis,Quatro notas de benchmark revisadas: Trinity Large Thinking foi o que mais caiu,Reavaliação do Artificial Analysis mexe em quatro modelos do catálogo,Quatro modelos tiveram a régua de benchmark movida pelo Artificial Analysis,Quatro reavaliações do Artificial Analysis em um só dia: o que muda na sua pilha

Trinity Large Thinking perdeu quase 26% da nota em uma só revisão; Gemma 4 E4B e DeepSeek V4 Flash também foram recalibrados.

Benchmarks

Qwen3.5 perde ponto no índice da Artificial Analysis

Versão de 0,8B cai quase um ponto de IQ; a de 35B A3B sobe pouco. Quem já tinha escolhido pelo número precisa reabrir a planilha.