Arquivo — 2025-09
58 reportagens neste mês.
GLM 4.6 entra no catálogo a US$ 1,75 por milhão de saída — e muda o cálculo da Z.ai
Janela de contexto salta de 128K para 200K tokens, mas preço de entrada subiu e o índice de inteligência continua sem medição pública.
Qwen3 VL Thinking custa metade do o3 — mas só se você precisar de visão
Modelo multimodal da Qwen entra sem nota de IQ publicada no catálogo, a US$ 4 por milhão de saída, e deixa em aberto se vale o gasto.
DeepSeek V3.2 Exp cobra US$ 0,41 por milhão de tokens de saída — e o catálogo não tem nota de inteligência
Modelo experimental chinês estreia com atenção esparsa e preço agressivo, mas sem benchmark público no índice que o mercado acompanha
Claude Sonnet 4.5 chega a US$ 15 por milhão de saída e mira o topo
Anthropic mantém o preço do antecessor enquanto reposiciona o modelo como carro-chefe para agentes e código, sem公布ar nota de inteligência.
Qwen3 VL 235B estreia sem nota de inteligência e custa 58% mais
Cinco dias depois do lançamento, o multimodal da Qwen segue sem índice publicado no catálogo. Custa US$ 1,90 por milhão de tokens de saída e mira casos em que texto sozinho não basta.
Qwen soltou quatro modelos em um dia; a semana foi isso
OpenAI entrou com o GPT-5 Codex a US$ 10 por milhão de tokens de saída, mas ninguém mexeu em preços — o movimento foi todo de catálogo.
Qwen3 Max cobra R$ 4 por milhão de saída — e o catálogo não publicou benchmark
Lançado há quatro dias, o flagship da Alibaba entra caro no texto de saída e caro no de entrada, sem nota de inteligência nem de coding no índice usado pelo blog.
Cydonia 24B V4.1 chega por US$ 0,50 por milhão de tokens de saída
TheDrummer lança versão do Cydonia baseada no Mistral Small 3.2 24B sem preço de referência de inteligência — entra como opção barata para escrita criativa.
Qwen3 Coder Plus custa 25 vezes mais que o gpt-oss-20b sem benchmark
Versão proprietária do modelo aberto da própria Qwen cobra US$ 3,25 por milhão de tokens de saída e entra no catálogo sem nota de inteligência, coding ou agentic
Qwen3 Coder Plus cobra US$ 4,40 por milhão de saída — vale para o seu pipeline?
Versão proprietária da Alibaba para o coder open source chega três dias depois com contexto de 1M e preço que não é o menor da categoria.
GPT-5 Codex cobra US$ 10 por milhão de saída e não tem nota de IQ
Dois dias depois do lançamento, o modelo de código da OpenAI chega caro, sem benchmark público no catálogo e competindo contra o3 que custa o mesmo para pensar — e melhor em quase tudo.
GPT-5 Codex custa 1.250 vezes mais que o gpt-oss-120b por token de entrada
Versão da OpenAI focada em engenharia de software estreia a US$ 1,25 por milhão de tokens de entrada e US$ 10 de saída — com cache promocional que derruba a leitura para US$ 0,125.
GPT-5 Codex em modo batch custa 8 vezes menos que o o3
Lançado ontem, o GPT-5 Codex na fila batch sai a US$ 0,625 por milhão de tokens de entrada — e tem 400 mil de contexto. Para quem roda agente de código, a conta muda de figura.
gpt-oss-20b custa 8,5 vezes menos que o Qwen3 Next 80B Instruct
Dois modelos abertos com MoE. A diferença mora no preço, na janela de contexto e em quem pensa antes de responder.
Qwen3 VL 235B Thinking custa metade do o3 e lê imagens
Modelo multimodal da Alibaba chega por US$ 4 por milhão de tokens de saída, com contexto de 131 mil — mas o índice de inteligência ainda não foi medido.
Qwen coloca visão de 235B no catálogo por US$ 4,40 por milhão de saída
Versão Thinking do Qwen3-VL estreia multimodal raciocinante a metade do preço do o3, mas sem nota de inteligência ainda medida
DeepSeek V3.1 Terminus chega sem índice de inteligência e cobra US$ 1 por milhão de saída
Update incremental do V3.1 corrige idioma e agente, mas o catálogo não publicou nota de IQ — então a pergunta é contra quem ele compete de verdade.
DeepSeek V3.1 Terminus entra a US$ 1/milhão e sem benchmark novo
Update da DeepSeek mantém preço do V3.1 e corrige consistência de idioma e agentes, mas catálogo não publicou índice de inteligência para comparar.
Três modelos novos saíram por menos de US$ 1 por milhão
Nenhum dos lançamentos brigou pelo topo de inteligência — todos apostaram em preço e nicho
Qwen3 Next cobra quase o mesmo e entrega quase o dobro de IQ
Comparativo entre dois modelos chineses open-weights mostra que a conta da API não revela quem pensa melhor — e quem nem entra na briga.