FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Qwen soltou quatro modelos em um dia; a semana foi isso

OpenAI entrou com o GPT-5 Codex a US$ 10 por milhão de tokens de saída, mas ninguém mexeu em preços — o movimento foi todo de catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 10,00por milhão de tokens de saída no GPT-5 Codex
US$ 0,40por milhão de tokens de saída no Gemini 2.5 Flash Lite Preview
10 lançamentos em 7 diastodos entre 22 e 28 de setembro, sem nenhum corte de preço

Qwen monopolizou a terça e o resto da semana

Dez lançamentos entre 22 e 28 de setembro, todos concentrados em poucos dias. E aqui está o detalhe que importa: seis deles caíram em 23 de setembro, e quatro são da Qwen. O catálogo hoje tem pelo menos 240 modelos de 40 criadores; em sete dias, a Qwen sozinha respondeu por 10% do que está disponível.

Lançamentos da semana por criador
qwen4openai2deepseek1google1relace1thedrummer1modelos

Para a conta da API, isso muda alguma coisa? Depende de qual chamada você faz.

A semana foi de código

Olha a lista do que chegou e o fio aparece sozinho: GPT-5 Codex, Qwen3 Coder Plus, Qwen3 VL Thinking, Relace Apply 3. Quatro dos dez lançamentos têm "code" ou "coder" no nome, e os dois modelos de visão da Qwen (VL Instruct e VL Thinking) são voltados para agentes que leem tela e diagramas — uso típico de quem monta ferramenta de código.

Lançamentos entre 2025-09-22 e 2025-09-28
DataModeloCriadorInteligênciaSaída US$/M
2025-09-22DeepSeek V3.1 Terminusdeepseek1
2025-09-23GPT-5 Codexopenai10
2025-09-23GPT-5 Codex (batch)openai5
2025-09-23Qwen3 Coder Plusqwen3.25
2025-09-23Qwen3 Maxqwen3.9
2025-09-23Qwen3 VL 235B A22B Instructqwen1.9
2025-09-23Qwen3 VL 235B A22B Thinkingqwen4
2025-09-25Gemini 2.5 Flash Lite Previegoogle0.4
2025-09-26Relace Apply 3relace1.25
2025-09-27Cydonia 24B V4.1thedrummer0.5

A OpenAI, vale notar, não entrou de graça. O GPT-5 Codex saiu a US$ 10 por milhão de tokens de saída. Tem a versão batch pelo mesmo modelo por US$ 5, mas batch significa fila: você não usa quando precisa de resposta em 200 ms. Para a fatura é metade; para a UX é outra conversa.

Onde está o barato

O que chegou de novo na faixa de baixo custo:

  • Google Gemini 2.5 Flash Lite Preview 09-2025: US$ 0,40 por milhão de tokens de saída
  • TheDrummer Cydonia 24B V4.1: US$ 0,50
  • DeepSeek V3.1 Terminus: US$ 1,00
  • Relace Apply 3: US$ 1,25
  • Qwen3 VL 235B A22B Instruct: US$ 1,90

Compare com o que já estava no topo do catálogo: o OpenAI o3 custa US$ 8 por milhão de tokens de saída. Você paga entre 5 e 20 vezes menos nos modelos novos de baixo custo, sem comparação direta de qualidade porque os lançamentos desta semana ainda não têm índice de inteligência calculado.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 240 modelos disponíveis no catálogo nesta data.

Esse é o ponto: nenhum dos dez lançamentos tem IQ medido pelo catálogo ainda. Você não compra hoje sabendo a nota; compra sabendo o preço e o nome.

Zero mudança de preço, e isso é notícia

Em uma semana com dez modelos novos, o número de reajustes foi zero. Nenhum corte, nenhum aumento. São 21 modelos lançados nos últimos 30 dias e o catálogo não mexeu em nenhuma etiqueta existente. Pode parecer detalhe, mas é o oposto do que se viu em vários momentos deste ano: o movimento agora é adicionar, não reprecificar.

Para quem está montando stack: o barulho desta semana está na prateleira de coders e de VL (visão-linguagem). Para quem usa o3, Sonnet, GPT-4o ou outro modelo âncora do dia a dia, a semana não tocou a fatura.

Para quem isso muda alguma coisa

Se você está escolhendo modelo de código ou agente agora: tem cinco opções novas em sete dias, de US$ 0,40 a US$ 10 por milhão de saída. Comece pela faixa de US$ 1 a US$ 4 — Qwen3 Coder Plus, Qwen3 Max, Qwen3 VL Thinking, Relace Apply 3, DeepSeek V3.1 Terminus — antes de ir para o GPT-5 Codex.

Se o seu uso é modelo âncora de chat ou raciocínio: nada mudou. O topo do catálogo segue o mesmo: OpenAI o3, GPT-OSS-120B, Qwen3 Next 80B A3B Thinking. Espere as medições de IQ dos novos chegarem antes de migrar.

Se você roda tudo em batch: o GPT-5 Codex batch a US$ 5 é a primeira referência séria de OpenAI em preço para processamento assíncrono. Vale testar contra o que você já usa, sabendo que é fila, não tempo real.

Em uma frase

Antes de mexer no seu modelo âncora, experimente um dos quatro coders novos da Qwen na faixa de US$ 1 a US$ 4 por milhão de tokens de saída — é onde está a melhor relação entre preço e novidade desta semana.

Perguntas frequentes

Qual foi o lançamento mais barato da semana?

O Google Gemini 2.5 Flash Lite Preview 09-2025, a US$ 0,40 por milhão de tokens de saída. TheDrummer Cydonia 24B V4.1 vem logo atrás, a US$ 0,50. Nenhum dos dois tem índice de inteligência calculado pelo catálogo ainda.

O GPT-5 Codex é o modelo mais caro da semana?

É o mais caro entre os lançamentos da semana, a US$ 10 por milhão de tokens de saída. Existe a versão batch pelo mesmo modelo a US$ 5, mas ela roda em fila, não em tempo real. Para comparar, o OpenAI o3, que já estava no catálogo, custa US$ 8.

Quantos modelos a Qwen lançou nesta semana?

Quatro, todos em 23 de setembro: Qwen3 Coder Plus (US$ 3,25), Qwen3 Max (US$ 3,90), Qwen3 VL 235B A22B Instruct (US$ 1,90) e Qwen3 VL 235B A22B Thinking (US$ 4,00). Foi o criador com mais lançamentos na semana.

Leia também