Seis modelos novos, nenhuma mudança de preço: a semana dos lite
Google, inclusionAI e Baidu entraram pelo chão da tabela; OpenAI subiu o teto com o GPT Chat Latest a US$ 30 por milhão de tokens de saída.
Seis modelos novos entraram no catálogo entre 4 e 10 de maio. Nenhum modelo existente mudou de preço. Quando a prateleira cresce sem mexer na etiqueta, vale olhar para o que está entrando — e para o que ficou parado.
A semana em que o Google apertou o chão
O Google foi o criador mais ativo da semana, com dois lançamentos no mesmo dia (7 de maio). Ambos são da família Flash Lite — a linha de baixo custo da casa, voltada para volume. A versão batch sai a US$ 0,75 por milhão de tokens de saída; a versão padrão, US$ 1,50, o dobro.
O detalhe operacional importa: a versão batch é para processamento em lote, sem garantia de latência nem janela de tempo firme. É a conta de quem roda extrações, classificações e resumos em background. A padrão mantém SLA e serve para produto em tempo real.
Nenhum dos dois tem índice de inteligência publicado ainda. Comparação direta com o restante do catálogo só fica possível depois da próxima rodada de medição.
OpenAI fez o movimento contrário
No dia seguinte ao Flash Lite, a OpenAI entrou com o GPT Chat Latest a US$ 30 por milhão de tokens de saída. É o lançamento mais caro da semana — e mais caro que o próprio Codex da casa (US$ 14) e que o Gemini 3.1 Pro Preview (US$ 12), os dois modelos acima de IQ 45 hoje.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Sem IQ publicado, o posicionamento se lê pela etiqueta. É o produto premium da linha, não uma opção intermediária. Se você precisa do topo da OpenAI para uma aplicação que justifica o gasto, a conta sobe — e ninguém da casa mexeu no Codex para baixo.
inclusionAI estreou com 1 trilhão de parâmetros
Dia 8 de maio, a inclusionAI lançou o Ring-2.6-1T, modelo que pelo nome declara 1 trilhão de parâmetros. IQ medido: 31,663. Preço: US$ 0,625 por milhão de tokens de saída — mais barato que a versão batch do Flash Lite da Google. A versão free do mesmo modelo zera o custo e entrou junto no mesmo dia.
Para situar o IQ 31,663: está abaixo de todos os modelos do topo desta data. Fica mais perto do MiMo-V2.5 da Xiaomi (38,043) e do MiMo-V2.5 Pro (42,88) do que do pódio. É um modelo de entrada da chinesa inclusionAI, não um candidato ao topo.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-05-05 | GPT Chat Latest | openai | — | 30 |
| 2026-05-06 | CoBuddy (free) | baidu | — | 0 |
| 2026-05-07 | Gemini 3.1 Flash Lite | — | 1.5 | |
| 2026-05-07 | Gemini 3.1 Flash Lite (batch | — | 0.75 | |
| 2026-05-08 | Ring-2.6-1T | inclusionai | 31.7 | 0.625 |
| 2026-05-08 | Ring-2.6-1T (free) | inclusionai | — | 0 |
Baidu também entrou na faixa free
Dia 6, a Baidu publicou o CoBuddy na faixa gratuita do catálogo. Sem IQ publicado. É a entrada da Baidu na semana — preço zero, sem dados de inteligência disponíveis.
O que essa semana diz sobre o mercado
Em sete dias, 6 modelos novos, zero alterações de preço em modelos já listados. O catálogo já passa de 441 entradas, com 60 criadores diferentes e 51 lançamentos só nos últimos 30 dias.
O padrão da semana é claro: de um lado, Google, inclusionAI e Baidu empurrando para baixo — lote, free, baratinhos. Do outro, a OpenAI empurrando para cima com o GPT Chat Latest. O meio do catálogo, com IQ na casa dos 40, segue dominado por DeepSeek e Xiaomi, e ninguém mexeu.
Para quem está montando stack:
- Se custo é variável decisivo, a semana trouxe opções reais. Ring-2.6-1T (US$ 0,625/M) e Flash Lite batch (US$ 0,75/M) entram na briga direta com DeepSeek V4 Pro (US$ 1,74/M) por workloads de baixo IQ necessário. Em volume, a diferença muda a fatura no fim do mês.
- Se o que importa é a faixa premium, o GPT Chat Latest a US$ 30/M redefine o teto de preço da OpenAI. Vale comparar com o Codex antes de subir de plano.
- Para workloads que pedem IQ acima de 45, nada mudou: o ranking segue Gemini 3.1 Pro Preview > Codex > DeepSeek V4 Pro, e os preços seguem os mesmos.
A implicação prática é direta: a semana não mexeu em quem está no topo, mas alargou a base por baixo e subiu o teto por cima. Para quem opera multi-modelo, vale testar pelo menos um dos novos baratinhos como fallback antes de pagar caro no topo.
Antes de renovar stack, inclua um dos baratinhos da semana (Ring-2.6-1T ou Flash Lite batch) como fallback do topo — se ele servir para parte do tráfego, a fatura cai sem perder o Codex ou Gemini 3.1 Pro Preview para o que realmente exige IQ alto.
Perguntas frequentes
Quanto custa o Gemini 3.1 Flash Lite lançado em maio de 2026?
A versão batch custa US$ 0,75 por milhão de tokens de saída, sem garantia de latência. A versão padrão custa US$ 1,50 e mantém SLA. Nenhuma das duas tem IQ publicado até agora.
O que é o GPT Chat Latest da OpenAI?
É o modelo lançado pela OpenAI em 5 de maio de 2026 ao preço de US$ 30 por milhão de tokens de saída — o lançamento mais caro da semana e mais caro que o próprio Codex da casa (US$ 14/M). Sem IQ publicado no catálogo.
Qual foi o modelo mais barato lançado na semana de 4 a 10 de maio?
O Ring-2.6-1T da inclusionAI, a US$ 0,625 por milhão de tokens de saída, com IQ medido de 31,663. A versão free do mesmo modelo entrou com preço zero no mesmo dia.