Qwen soltou quatro modelos em um dia; a semana foi isso
OpenAI entrou com o GPT-5 Codex a US$ 10 por milhão de tokens de saída, mas ninguém mexeu em preços — o movimento foi todo de catálogo.
Qwen monopolizou a terça e o resto da semana
Dez lançamentos entre 22 e 28 de setembro, todos concentrados em poucos dias. E aqui está o detalhe que importa: seis deles caíram em 23 de setembro, e quatro são da Qwen. O catálogo hoje tem pelo menos 240 modelos de 40 criadores; em sete dias, a Qwen sozinha respondeu por 10% do que está disponível.
Para a conta da API, isso muda alguma coisa? Depende de qual chamada você faz.
A semana foi de código
Olha a lista do que chegou e o fio aparece sozinho: GPT-5 Codex, Qwen3 Coder Plus, Qwen3 VL Thinking, Relace Apply 3. Quatro dos dez lançamentos têm "code" ou "coder" no nome, e os dois modelos de visão da Qwen (VL Instruct e VL Thinking) são voltados para agentes que leem tela e diagramas — uso típico de quem monta ferramenta de código.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2025-09-22 | DeepSeek V3.1 Terminus | deepseek | — | 1 |
| 2025-09-23 | GPT-5 Codex | openai | — | 10 |
| 2025-09-23 | GPT-5 Codex (batch) | openai | — | 5 |
| 2025-09-23 | Qwen3 Coder Plus | qwen | — | 3.25 |
| 2025-09-23 | Qwen3 Max | qwen | — | 3.9 |
| 2025-09-23 | Qwen3 VL 235B A22B Instruct | qwen | — | 1.9 |
| 2025-09-23 | Qwen3 VL 235B A22B Thinking | qwen | — | 4 |
| 2025-09-25 | Gemini 2.5 Flash Lite Previe | — | 0.4 | |
| 2025-09-26 | Relace Apply 3 | relace | — | 1.25 |
| 2025-09-27 | Cydonia 24B V4.1 | thedrummer | — | 0.5 |
A OpenAI, vale notar, não entrou de graça. O GPT-5 Codex saiu a US$ 10 por milhão de tokens de saída. Tem a versão batch pelo mesmo modelo por US$ 5, mas batch significa fila: você não usa quando precisa de resposta em 200 ms. Para a fatura é metade; para a UX é outra conversa.
Onde está o barato
O que chegou de novo na faixa de baixo custo:
- Google Gemini 2.5 Flash Lite Preview 09-2025: US$ 0,40 por milhão de tokens de saída
- TheDrummer Cydonia 24B V4.1: US$ 0,50
- DeepSeek V3.1 Terminus: US$ 1,00
- Relace Apply 3: US$ 1,25
- Qwen3 VL 235B A22B Instruct: US$ 1,90
Compare com o que já estava no topo do catálogo: o OpenAI o3 custa US$ 8 por milhão de tokens de saída. Você paga entre 5 e 20 vezes menos nos modelos novos de baixo custo, sem comparação direta de qualidade porque os lançamentos desta semana ainda não têm índice de inteligência calculado.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Esse é o ponto: nenhum dos dez lançamentos tem IQ medido pelo catálogo ainda. Você não compra hoje sabendo a nota; compra sabendo o preço e o nome.
Zero mudança de preço, e isso é notícia
Em uma semana com dez modelos novos, o número de reajustes foi zero. Nenhum corte, nenhum aumento. São 21 modelos lançados nos últimos 30 dias e o catálogo não mexeu em nenhuma etiqueta existente. Pode parecer detalhe, mas é o oposto do que se viu em vários momentos deste ano: o movimento agora é adicionar, não reprecificar.
Para quem está montando stack: o barulho desta semana está na prateleira de coders e de VL (visão-linguagem). Para quem usa o3, Sonnet, GPT-4o ou outro modelo âncora do dia a dia, a semana não tocou a fatura.
Para quem isso muda alguma coisa
Se você está escolhendo modelo de código ou agente agora: tem cinco opções novas em sete dias, de US$ 0,40 a US$ 10 por milhão de saída. Comece pela faixa de US$ 1 a US$ 4 — Qwen3 Coder Plus, Qwen3 Max, Qwen3 VL Thinking, Relace Apply 3, DeepSeek V3.1 Terminus — antes de ir para o GPT-5 Codex.
Se o seu uso é modelo âncora de chat ou raciocínio: nada mudou. O topo do catálogo segue o mesmo: OpenAI o3, GPT-OSS-120B, Qwen3 Next 80B A3B Thinking. Espere as medições de IQ dos novos chegarem antes de migrar.
Se você roda tudo em batch: o GPT-5 Codex batch a US$ 5 é a primeira referência séria de OpenAI em preço para processamento assíncrono. Vale testar contra o que você já usa, sabendo que é fila, não tempo real.
Antes de mexer no seu modelo âncora, experimente um dos quatro coders novos da Qwen na faixa de US$ 1 a US$ 4 por milhão de tokens de saída — é onde está a melhor relação entre preço e novidade desta semana.
Perguntas frequentes
Qual foi o lançamento mais barato da semana?
O Google Gemini 2.5 Flash Lite Preview 09-2025, a US$ 0,40 por milhão de tokens de saída. TheDrummer Cydonia 24B V4.1 vem logo atrás, a US$ 0,50. Nenhum dos dois tem índice de inteligência calculado pelo catálogo ainda.
O GPT-5 Codex é o modelo mais caro da semana?
É o mais caro entre os lançamentos da semana, a US$ 10 por milhão de tokens de saída. Existe a versão batch pelo mesmo modelo a US$ 5, mas ela roda em fila, não em tempo real. Para comparar, o OpenAI o3, que já estava no catálogo, custa US$ 8.
Quantos modelos a Qwen lançou nesta semana?
Quatro, todos em 23 de setembro: Qwen3 Coder Plus (US$ 3,25), Qwen3 Max (US$ 3,90), Qwen3 VL 235B A22B Instruct (US$ 1,90) e Qwen3 VL 235B A22B Thinking (US$ 4,00). Foi o criador com mais lançamentos na semana.