FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Quatro lançamentos em sete dias e zero corte de preço

Google, SpaceXAI e Qwen entraram em campo na mesma semana; o catálogo passou de 440 modelos sem mexer nas tabelas.

Redação FalaVIP IA 3 min de leitura
4modelos lançados entre 18 e 24 de maio
US$ 4,50por milhão de tokens de saída do Gemini 3.5 Flash em modo batch
0mudanças de preço no catálogo na semana

Você olha o painel da API no fim do mês e quer entender por que a fatura anda estranha? A resposta desta semana está na prateleira, não na tabela de preços.

Foram quatro modelos novos entre 18 e 24 de maio de 2026. Nenhum corte, nenhum aumento. Em um mercado acostumado a rebalancear tarifa a cada quinze dias, uma semana sem mexer em preço já é notícia — e ela diz mais sobre a estratégia dos fornecedores do que qualquer release.

Lançamentos entre 2026-05-18 e 2026-05-24
DataModeloCriadorInteligênciaSaída US$/M
2026-05-19Gemini 3.5 Flashgoogle46.79
2026-05-19Gemini 3.5 Flash (batch)google4.5
2026-05-20Grok Build 0.1x-ai2
2026-05-21Qwen3.7 Maxqwen4.425

Google acelera a linha Flash

A Google foi quem mais movimentou o tabuleiro. No dia 19, entraram duas variantes do Gemini 3.5 Flash: a versão padrão, a US$ 9 por milhão de tokens de saída, e a versão batch, pela metade — US$ 4,50. O índice de inteligência atual da versão padrão está em 46,673, o segundo melhor do catálogo inteiro.

Traduzindo o marketing: "batch" aqui é o mesmo modelo servido com latência maior e desconto agressivo. Pense na diferença entre um sedex e uma entrega econômica de e-commerce: chega no mesmo lugar, só leva mais tempo. Para jobs noturnos de indexação, sumarização em massa ou reescrita de base de conhecimento, a conta cai pela metade sem perder o modelo top-tier.

Para quem vale: times que rodam pipelines assíncronos com volume alto e podem esperar minutos pelo retorno. Para quem não muda nada: qualquer produto interativo onde o usuário está esperando resposta na tela — ali a versão padrão continua sendo a escolha.

SpaceXAI estreia com preço de entrada

No dia 20, a SpaceXAI colocou no catálogo o Grok Build 0.1 a US$ 2 por milhão de tokens de saída. Não há índice de inteligência publicado ainda — é um modelo novo, sem benchmark consolidado. O que chama atenção é o posicionamento: é o lançamento mais barato da semana, abaixo do Qwen3.7 Max (US$ 4,425) e bem distante do Gemini padrão.

É cedo para cravar. Sem nota de IQ, "barato" é só "barato". Vale para quem está testando a família xAI e quer colocar um modelo novo no radar antes que o catálogo meça. Não vale para colocar em produção sem antes rodar a sua suíte de avaliação — porque a ausência de benchmark público é um sinal de alerta, não de oportunidade.

Qwen entra com o Max

A Alibaba voltou à carga no dia 21 com o Qwen3.7 Max, a US$ 4,425 por milhão de tokens de saída. Também sem índice de inteligência publicado. A faixa de preço fica entre o Flash batch do Google e a versão padrão do Flash — o que sugere um posicionamento de meio de campo, brigando por workloads que não são nem os mais sensíveis a latência nem os mais sensíveis a custo.

Lançamentos da semana por criador
google2x-ai1qwen1modelos

O que a semana diz sobre o mercado

Três movimentos em quatro lançamentos apontam para a mesma direção: pressão sobre o preço do token de saída. Google cortou pela metade no modo batch, SpaceXAI entrou abaixo de US$ 3, Qwen se acomodou na faixa dos US$ 4. O único lançamento "caro" da semana é o Gemini 3.5 Flash padrão, e ele é o que entrega o melhor IQ por dólar entre os modelos acima de 45 pontos.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
Entre os 447 modelos disponíveis no catálogo nesta data.

O catálogo fechou a semana com mais de 440 modelos e 61 criadores diferentes. O índice mais alto segue sendo do Gemini 3.1 Pro Preview (47,738), seguido de perto pelo novo Flash. A DeepSeek continua reinando no custo-benefício acima de IQ 45: o V4 Pro 0423 entrega 45,268 pontos a US$ 1,74 por milhão de tokens de saída — quase 6,5 vezes mais barato que o Gemini padrão.

Para quem vale o resumo: se você roda volume, a semana mostrou que dá para pagar menos sem trocar de família de modelo. Para quem não muda nada: quem usa GPT-5.3-Codex ou Gemini Pro Preview em tarefas que exigem raciocínio pesado continua sem alternativa melhor no catálogo — o topo da pirâmide não se mexeu.

A implicação prática é direta: antes de aprovar a próxima fatura, rode um teste A/B entre o Gemini 3.5 Flash batch e o que você usa hoje em jobs que podem esperar. A diferença na conta pode pagar o almoço da equipe por um trimestre.

Em uma frase

Antes de aprovar a próxima fatura, teste o Gemini 3.5 Flash em modo batch nos jobs que toleram latência maior — a conta pode cair pela metade sem trocar de família de modelo.

Perguntas frequentes

Qual modelo lançou na semana de 18 a 24 de maio de 2026?

Foram quatro: Google Gemini 3.5 Flash (padrão e batch) no dia 19, SpaceXAI Grok Build 0.1 no dia 20 e Qwen3.7 Max no dia 21. Nenhum outro criador publicou modelo novo no período.

Houve corte de preço em maio de 2026?

Não. A semana entre 18 e 24 de maio fechou com zero alterações de preço no catálogo. Os descontos apareceram como variantes de produto — caso do Gemini 3.5 Flash batch, que custa metade da versão padrão.

Qual é o modelo com melhor custo-benefício acima de IQ 45 hoje?

O DeepSeek V4 Pro 0423, com índice 45,268 e preço de US$ 1,74 por milhão de tokens de saída. É quase 6,5 vezes mais barato que o Gemini 3.5 Flash padrão, que entrega índice próximo (46,673) por US$ 9.

Leia também