FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-09

58 reportagens neste mês.

Análise

29 modelos vendem 1 milhão de tokens de contexto — e só 2 valem o preço

O catálogo de hoje tem 29 opções com janela longa, mas a conta muda quando você compara o que cabe no envelope e o que cabe no boleto.

Análise

Qwen3 Next 80B A3B Thinking cobra 1,2 dólar; Llama 3.3 70B cobra 0,71 — quem entrega mais pelo preço

Comparativo frente a frente entre o modelo de raciocínio chinês de 11 de setembro e o clássico aberto da Meta, com conta de API, contexto e benchmark na mesa

Lançamentos

Grok 4 Fast chega a US$ 0,50 por milhão de tokens de saída

xAI estreia modelo multimodal com janela de 2 milhões de tokens; preço de saída é 16 vezes menor que o do OpenAI o3.

Análise

Grok 4 Fast cobra US$ 0,50 por milhão de saída e entra sem nota de IQ

xAI promete custo SOTA e 2 milhões de tokens de contexto, mas o catálogo não publicou índice de inteligência, velocidade nem país de origem.

Análise

Tongyi DeepResearch 30B A3B: 3B ativos por US$ 0,45/milhão

Lançado hoje pela Tongyi Lab, o modelo agentic estreia sem nota de inteligência publicada e aposta em pesquisa longa a preço de commodity.

Lançamentos

Tongyi DeepResearch 30B A3B chega por US$ 0,45 por milhão de tokens de saída

Modelo agentic da Alibaba com 30B de parâmetros totais e 3B ativos mira tarefas longas de pesquisa — e cobra menos que o o3-mini, mas sem nota de inteligência medida

Análise

Qwen3 Coder Flash cobra US$ 0,98/M de saída e não é o mais barato do mercado

A Alibaba prometeu uma versão enxuta do Qwen3 Coder Plus. O preço de tabela mostra que a economia é relativa à família, não ao mercado como um todo.

Análise

Qwen3 Coder Flash cobra US$ 0,98 por milhão de saída e mira o seu agente

Versão enxuta do coder da Alibaba chega com contexto de 1M, cache barato e preço que incomoda a OpenAI no segmento de programação.

Análise

12 modelos com pesos abertos, mas só 4 valem a conta

O catálogo aberto soma 12 opções; o recorte mostra que metade fica abaixo de IQ 14 e só um passa dos 24.

Análise

Os 12 modelos de pesos abertos do catálogo custam 90% menos que o topo

O melhor open-weight hoje tem IQ 24,1 e cobra US$ 0,17 por milhão de tokens de saída — quase 50 vezes mais barato que o líder absoluto do catálogo.

Análise

Qwen3 Next 80B A3B Thinking custa 72% mais caro na saída que o Llama 4 Maverick

O modelo chinês de raciocínio entrega nota mais alta de inteligência e codificação, mas cobra quase o dobro por token gerado e roda mais lento.

Análise

Qwen3 Next grátis: o que 80 bilhões entregam de verdade

Versão Instruct do Qwen3-Next chega sem custo, mas não é troca direta do modelo de raciocínio.

Retrospectiva

Qwen emplaca cinco modelos em sete dias e ninguém da Big Tech mexeu

Semana foi de movimento só do lado chinês: Qwen Plus 0728 e a família Qwen3 Next 80B A3B entraram no catálogo enquanto OpenAI, Anthropic e Google ficaram quietos.

Análise

Qwen Plus 0728: o modelo de US$ 0,78 que ninguém está olhando

Lançado há seis dias pela Alibaba, o Qwen Plus 0728 cobra quase dez vezes menos que o o3 por milhão de tokens de saída — mas o silêncio em torno dele diz algo.

Análise

Qwen3 Next 80B cobra 9 vezes mais saída que gpt-oss-20b

Comparativo frente a frente mostra qual dos dois modelos de código aberto vale o que custa — e em qual cenário cada um leva a melhor.

Análise

Qwen Plus 0728 thinking custa 10× menos que o o3 sem IQ publicado

Modelo entra no catálogo com 1 milhão de contexto e preço de meio-termo. Falta o número que diz se a conta fecha.

Análise

O Qwen3 Next Instruct cobra US$ 1,10 por milhão e perde do próprio irmão

Lançado ontem pela Alibaba, o modelo aberto de 80B/3B ativos aposta em velocidade e contexto de 256k — mas o preço de saída e o IQ abaixo da variante Thinking dificultam a conta.

Análise

Qwen3 Next 80B estreou ontem e já perde do gpt-oss-120b em preço e IQ

Mesmo na corrida do open-weight, a conta fecha a favor da OpenAI: o gpt-oss-120b custa US$ 0,17 por milhão de tokens de saída e pontua mais em raciocínio, código e agentic.

Lançamentos

Qwen3-Next 80B A3B Thinking custa 85% menos que o3 na saída

Modelo de raciocínio da Alibaba entra com 3 bilhões de parâmetros ativos e preço de US$ 1,20 por milhão de tokens de saída — mas fica bem abaixo do topo do índice de inteligência.

Análise

Qwen3 Thinking estreia cobrando 9× mais que gpt-oss-20b no token de saída

Modelo de raciocínio chinês tem 80B de parâmetros totais e só 3B ativos. A conta sai cara, mas há um nicho onde a conta fecha.

← anteriores página 2 de 3 próximas →