FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Seis modelos novos, nenhuma mudança de preço: a semana dos lite

Google, inclusionAI e Baidu entraram pelo chão da tabela; OpenAI subiu o teto com o GPT Chat Latest a US$ 30 por milhão de tokens de saída.

Redação FalaVIP IA 3 min de leitura
US$ 30por milhão de tokens de saída do GPT Chat Latest
US$ 0,625por milhão de tokens de saída do Ring-2.6-1T
0alterações de preço em modelos já listados na semana

Seis modelos novos entraram no catálogo entre 4 e 10 de maio. Nenhum modelo existente mudou de preço. Quando a prateleira cresce sem mexer na etiqueta, vale olhar para o que está entrando — e para o que ficou parado.

Lançamentos da semana por criador
google2inclusionai2openai1baidu1modelos

A semana em que o Google apertou o chão

O Google foi o criador mais ativo da semana, com dois lançamentos no mesmo dia (7 de maio). Ambos são da família Flash Lite — a linha de baixo custo da casa, voltada para volume. A versão batch sai a US$ 0,75 por milhão de tokens de saída; a versão padrão, US$ 1,50, o dobro.

O detalhe operacional importa: a versão batch é para processamento em lote, sem garantia de latência nem janela de tempo firme. É a conta de quem roda extrações, classificações e resumos em background. A padrão mantém SLA e serve para produto em tempo real.

Nenhum dos dois tem índice de inteligência publicado ainda. Comparação direta com o restante do catálogo só fica possível depois da próxima rodada de medição.

OpenAI fez o movimento contrário

No dia seguinte ao Flash Lite, a OpenAI entrou com o GPT Chat Latest a US$ 30 por milhão de tokens de saída. É o lançamento mais caro da semana — e mais caro que o próprio Codex da casa (US$ 14) e que o Gemini 3.1 Pro Preview (US$ 12), os dois modelos acima de IQ 45 hoje.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 441 modelos disponíveis no catálogo nesta data.

Sem IQ publicado, o posicionamento se lê pela etiqueta. É o produto premium da linha, não uma opção intermediária. Se você precisa do topo da OpenAI para uma aplicação que justifica o gasto, a conta sobe — e ninguém da casa mexeu no Codex para baixo.

inclusionAI estreou com 1 trilhão de parâmetros

Dia 8 de maio, a inclusionAI lançou o Ring-2.6-1T, modelo que pelo nome declara 1 trilhão de parâmetros. IQ medido: 31,663. Preço: US$ 0,625 por milhão de tokens de saída — mais barato que a versão batch do Flash Lite da Google. A versão free do mesmo modelo zera o custo e entrou junto no mesmo dia.

Para situar o IQ 31,663: está abaixo de todos os modelos do topo desta data. Fica mais perto do MiMo-V2.5 da Xiaomi (38,043) e do MiMo-V2.5 Pro (42,88) do que do pódio. É um modelo de entrada da chinesa inclusionAI, não um candidato ao topo.

Lançamentos entre 2026-05-04 e 2026-05-10
DataModeloCriadorInteligênciaSaída US$/M
2026-05-05GPT Chat Latestopenai30
2026-05-06CoBuddy (free)baidu0
2026-05-07Gemini 3.1 Flash Litegoogle1.5
2026-05-07Gemini 3.1 Flash Lite (batchgoogle0.75
2026-05-08Ring-2.6-1Tinclusionai31.70.625
2026-05-08Ring-2.6-1T (free)inclusionai0

Baidu também entrou na faixa free

Dia 6, a Baidu publicou o CoBuddy na faixa gratuita do catálogo. Sem IQ publicado. É a entrada da Baidu na semana — preço zero, sem dados de inteligência disponíveis.

O que essa semana diz sobre o mercado

Em sete dias, 6 modelos novos, zero alterações de preço em modelos já listados. O catálogo já passa de 441 entradas, com 60 criadores diferentes e 51 lançamentos só nos últimos 30 dias.

O padrão da semana é claro: de um lado, Google, inclusionAI e Baidu empurrando para baixo — lote, free, baratinhos. Do outro, a OpenAI empurrando para cima com o GPT Chat Latest. O meio do catálogo, com IQ na casa dos 40, segue dominado por DeepSeek e Xiaomi, e ninguém mexeu.

Para quem está montando stack:

  • Se custo é variável decisivo, a semana trouxe opções reais. Ring-2.6-1T (US$ 0,625/M) e Flash Lite batch (US$ 0,75/M) entram na briga direta com DeepSeek V4 Pro (US$ 1,74/M) por workloads de baixo IQ necessário. Em volume, a diferença muda a fatura no fim do mês.
  • Se o que importa é a faixa premium, o GPT Chat Latest a US$ 30/M redefine o teto de preço da OpenAI. Vale comparar com o Codex antes de subir de plano.
  • Para workloads que pedem IQ acima de 45, nada mudou: o ranking segue Gemini 3.1 Pro Preview > Codex > DeepSeek V4 Pro, e os preços seguem os mesmos.

A implicação prática é direta: a semana não mexeu em quem está no topo, mas alargou a base por baixo e subiu o teto por cima. Para quem opera multi-modelo, vale testar pelo menos um dos novos baratinhos como fallback antes de pagar caro no topo.

Em uma frase

Antes de renovar stack, inclua um dos baratinhos da semana (Ring-2.6-1T ou Flash Lite batch) como fallback do topo — se ele servir para parte do tráfego, a fatura cai sem perder o Codex ou Gemini 3.1 Pro Preview para o que realmente exige IQ alto.

Perguntas frequentes

Quanto custa o Gemini 3.1 Flash Lite lançado em maio de 2026?

A versão batch custa US$ 0,75 por milhão de tokens de saída, sem garantia de latência. A versão padrão custa US$ 1,50 e mantém SLA. Nenhuma das duas tem IQ publicado até agora.

O que é o GPT Chat Latest da OpenAI?

É o modelo lançado pela OpenAI em 5 de maio de 2026 ao preço de US$ 30 por milhão de tokens de saída — o lançamento mais caro da semana e mais caro que o próprio Codex da casa (US$ 14/M). Sem IQ publicado no catálogo.

Qual foi o modelo mais barato lançado na semana de 4 a 10 de maio?

O Ring-2.6-1T da inclusionAI, a US$ 0,625 por milhão de tokens de saída, com IQ medido de 31,663. A versão free do mesmo modelo entrou com preço zero no mesmo dia.

Leia também