Quatro lançamentos em sete dias e zero corte de preço
Google, SpaceXAI e Qwen entraram em campo na mesma semana; o catálogo passou de 440 modelos sem mexer nas tabelas.
Você olha o painel da API no fim do mês e quer entender por que a fatura anda estranha? A resposta desta semana está na prateleira, não na tabela de preços.
Foram quatro modelos novos entre 18 e 24 de maio de 2026. Nenhum corte, nenhum aumento. Em um mercado acostumado a rebalancear tarifa a cada quinze dias, uma semana sem mexer em preço já é notícia — e ela diz mais sobre a estratégia dos fornecedores do que qualquer release.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-05-19 | Gemini 3.5 Flash | 46.7 | 9 | |
| 2026-05-19 | Gemini 3.5 Flash (batch) | — | 4.5 | |
| 2026-05-20 | Grok Build 0.1 | x-ai | — | 2 |
| 2026-05-21 | Qwen3.7 Max | qwen | — | 4.425 |
Google acelera a linha Flash
A Google foi quem mais movimentou o tabuleiro. No dia 19, entraram duas variantes do Gemini 3.5 Flash: a versão padrão, a US$ 9 por milhão de tokens de saída, e a versão batch, pela metade — US$ 4,50. O índice de inteligência atual da versão padrão está em 46,673, o segundo melhor do catálogo inteiro.
Traduzindo o marketing: "batch" aqui é o mesmo modelo servido com latência maior e desconto agressivo. Pense na diferença entre um sedex e uma entrega econômica de e-commerce: chega no mesmo lugar, só leva mais tempo. Para jobs noturnos de indexação, sumarização em massa ou reescrita de base de conhecimento, a conta cai pela metade sem perder o modelo top-tier.
Para quem vale: times que rodam pipelines assíncronos com volume alto e podem esperar minutos pelo retorno. Para quem não muda nada: qualquer produto interativo onde o usuário está esperando resposta na tela — ali a versão padrão continua sendo a escolha.
SpaceXAI estreia com preço de entrada
No dia 20, a SpaceXAI colocou no catálogo o Grok Build 0.1 a US$ 2 por milhão de tokens de saída. Não há índice de inteligência publicado ainda — é um modelo novo, sem benchmark consolidado. O que chama atenção é o posicionamento: é o lançamento mais barato da semana, abaixo do Qwen3.7 Max (US$ 4,425) e bem distante do Gemini padrão.
É cedo para cravar. Sem nota de IQ, "barato" é só "barato". Vale para quem está testando a família xAI e quer colocar um modelo novo no radar antes que o catálogo meça. Não vale para colocar em produção sem antes rodar a sua suíte de avaliação — porque a ausência de benchmark público é um sinal de alerta, não de oportunidade.
Qwen entra com o Max
A Alibaba voltou à carga no dia 21 com o Qwen3.7 Max, a US$ 4,425 por milhão de tokens de saída. Também sem índice de inteligência publicado. A faixa de preço fica entre o Flash batch do Google e a versão padrão do Flash — o que sugere um posicionamento de meio de campo, brigando por workloads que não são nem os mais sensíveis a latência nem os mais sensíveis a custo.
O que a semana diz sobre o mercado
Três movimentos em quatro lançamentos apontam para a mesma direção: pressão sobre o preço do token de saída. Google cortou pela metade no modo batch, SpaceXAI entrou abaixo de US$ 3, Qwen se acomodou na faixa dos US$ 4. O único lançamento "caro" da semana é o Gemini 3.5 Flash padrão, e ele é o que entrega o melhor IQ por dólar entre os modelos acima de 45 pontos.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
O catálogo fechou a semana com mais de 440 modelos e 61 criadores diferentes. O índice mais alto segue sendo do Gemini 3.1 Pro Preview (47,738), seguido de perto pelo novo Flash. A DeepSeek continua reinando no custo-benefício acima de IQ 45: o V4 Pro 0423 entrega 45,268 pontos a US$ 1,74 por milhão de tokens de saída — quase 6,5 vezes mais barato que o Gemini padrão.
Para quem vale o resumo: se você roda volume, a semana mostrou que dá para pagar menos sem trocar de família de modelo. Para quem não muda nada: quem usa GPT-5.3-Codex ou Gemini Pro Preview em tarefas que exigem raciocínio pesado continua sem alternativa melhor no catálogo — o topo da pirâmide não se mexeu.
A implicação prática é direta: antes de aprovar a próxima fatura, rode um teste A/B entre o Gemini 3.5 Flash batch e o que você usa hoje em jobs que podem esperar. A diferença na conta pode pagar o almoço da equipe por um trimestre.
Antes de aprovar a próxima fatura, teste o Gemini 3.5 Flash em modo batch nos jobs que toleram latência maior — a conta pode cair pela metade sem trocar de família de modelo.
Perguntas frequentes
Qual modelo lançou na semana de 18 a 24 de maio de 2026?
Foram quatro: Google Gemini 3.5 Flash (padrão e batch) no dia 19, SpaceXAI Grok Build 0.1 no dia 20 e Qwen3.7 Max no dia 21. Nenhum outro criador publicou modelo novo no período.
Houve corte de preço em maio de 2026?
Não. A semana entre 18 e 24 de maio fechou com zero alterações de preço no catálogo. Os descontos apareceram como variantes de produto — caso do Gemini 3.5 Flash batch, que custa metade da versão padrão.
Qual é o modelo com melhor custo-benefício acima de IQ 45 hoje?
O DeepSeek V4 Pro 0423, com índice 45,268 e preço de US$ 1,74 por milhão de tokens de saída. É quase 6,5 vezes mais barato que o Gemini 3.5 Flash padrão, que entrega índice próximo (46,673) por US$ 9.