Arquivo — 2025-09
58 reportagens neste mês.
29 modelos vendem 1 milhão de tokens de contexto — e só 2 valem o preço
O catálogo de hoje tem 29 opções com janela longa, mas a conta muda quando você compara o que cabe no envelope e o que cabe no boleto.
Qwen3 Next 80B A3B Thinking cobra 1,2 dólar; Llama 3.3 70B cobra 0,71 — quem entrega mais pelo preço
Comparativo frente a frente entre o modelo de raciocínio chinês de 11 de setembro e o clássico aberto da Meta, com conta de API, contexto e benchmark na mesa
Grok 4 Fast chega a US$ 0,50 por milhão de tokens de saída
xAI estreia modelo multimodal com janela de 2 milhões de tokens; preço de saída é 16 vezes menor que o do OpenAI o3.
Grok 4 Fast cobra US$ 0,50 por milhão de saída e entra sem nota de IQ
xAI promete custo SOTA e 2 milhões de tokens de contexto, mas o catálogo não publicou índice de inteligência, velocidade nem país de origem.
Tongyi DeepResearch 30B A3B: 3B ativos por US$ 0,45/milhão
Lançado hoje pela Tongyi Lab, o modelo agentic estreia sem nota de inteligência publicada e aposta em pesquisa longa a preço de commodity.
Tongyi DeepResearch 30B A3B chega por US$ 0,45 por milhão de tokens de saída
Modelo agentic da Alibaba com 30B de parâmetros totais e 3B ativos mira tarefas longas de pesquisa — e cobra menos que o o3-mini, mas sem nota de inteligência medida
Qwen3 Coder Flash cobra US$ 0,98/M de saída e não é o mais barato do mercado
A Alibaba prometeu uma versão enxuta do Qwen3 Coder Plus. O preço de tabela mostra que a economia é relativa à família, não ao mercado como um todo.
Qwen3 Coder Flash cobra US$ 0,98 por milhão de saída e mira o seu agente
Versão enxuta do coder da Alibaba chega com contexto de 1M, cache barato e preço que incomoda a OpenAI no segmento de programação.
12 modelos com pesos abertos, mas só 4 valem a conta
O catálogo aberto soma 12 opções; o recorte mostra que metade fica abaixo de IQ 14 e só um passa dos 24.
Os 12 modelos de pesos abertos do catálogo custam 90% menos que o topo
O melhor open-weight hoje tem IQ 24,1 e cobra US$ 0,17 por milhão de tokens de saída — quase 50 vezes mais barato que o líder absoluto do catálogo.
Qwen3 Next 80B A3B Thinking custa 72% mais caro na saída que o Llama 4 Maverick
O modelo chinês de raciocínio entrega nota mais alta de inteligência e codificação, mas cobra quase o dobro por token gerado e roda mais lento.
Qwen3 Next grátis: o que 80 bilhões entregam de verdade
Versão Instruct do Qwen3-Next chega sem custo, mas não é troca direta do modelo de raciocínio.
Qwen emplaca cinco modelos em sete dias e ninguém da Big Tech mexeu
Semana foi de movimento só do lado chinês: Qwen Plus 0728 e a família Qwen3 Next 80B A3B entraram no catálogo enquanto OpenAI, Anthropic e Google ficaram quietos.
Qwen Plus 0728: o modelo de US$ 0,78 que ninguém está olhando
Lançado há seis dias pela Alibaba, o Qwen Plus 0728 cobra quase dez vezes menos que o o3 por milhão de tokens de saída — mas o silêncio em torno dele diz algo.
Qwen3 Next 80B cobra 9 vezes mais saída que gpt-oss-20b
Comparativo frente a frente mostra qual dos dois modelos de código aberto vale o que custa — e em qual cenário cada um leva a melhor.
Qwen Plus 0728 thinking custa 10× menos que o o3 sem IQ publicado
Modelo entra no catálogo com 1 milhão de contexto e preço de meio-termo. Falta o número que diz se a conta fecha.
O Qwen3 Next Instruct cobra US$ 1,10 por milhão e perde do próprio irmão
Lançado ontem pela Alibaba, o modelo aberto de 80B/3B ativos aposta em velocidade e contexto de 256k — mas o preço de saída e o IQ abaixo da variante Thinking dificultam a conta.
Qwen3 Next 80B estreou ontem e já perde do gpt-oss-120b em preço e IQ
Mesmo na corrida do open-weight, a conta fecha a favor da OpenAI: o gpt-oss-120b custa US$ 0,17 por milhão de tokens de saída e pontua mais em raciocínio, código e agentic.
Qwen3-Next 80B A3B Thinking custa 85% menos que o3 na saída
Modelo de raciocínio da Alibaba entra com 3 bilhões de parâmetros ativos e preço de US$ 1,20 por milhão de tokens de saída — mas fica bem abaixo do topo do índice de inteligência.
Qwen3 Thinking estreia cobrando 9× mais que gpt-oss-20b no token de saída
Modelo de raciocínio chinês tem 80B de parâmetros totais e só 3B ativos. A conta sai cara, mas há um nicho onde a conta fecha.