FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-02

55 reportagens neste mês.

Análise

Sonnet 4.6 lidera em IQ, mas cobra 6,4× mais caro que Qwen 3.5

Lançados com 48 horas de diferença, os dois modelos disputam o topo de um catálogo de 338 com propostas opostas: fechado nos EUA a US$ 15 por milhão de tokens de saída, ou pesos abertos na China a US$ 2,34.

Análise

Claude Sonnet 4.6 lidera em inteligência, mas cobra US$ 15 por milhão de saída

O modelo mais capaz do catálogo hoje custa 6,4 vezes o Qwen 3.5 e 50 vezes o MiMo-V2-Flash — vale a diferença?

Lançamentos

Claude Sonnet 4.6 assume o topo de inteligência, mas custa 50x mais que o Xiaomi

Anthropic lança o modelo mais capaz do catálogo, com IQ 35,1 e janela de 1 milhão de tokens — só que o preço de US$ 15 por milhão de tokens de saída deixa a conta dura para quem roda volume.

Lançamentos

Qwen3.5 397B A17B assume topo do ranking de inteligência, mas Xiaomi cobra 1/8 do preço

Modelo aberto da chinesa Qwen é hoje o mais bem pontuado do índice — e o segundo lugar cobra pouco mais de um oitavo por token de saída.

Análise

Qwen3.5 397B A17B lidera por 0,24 ponto e cobra 8 vezes menos que o3

Modelo chinês de pesos abertos estreia no topo do índice de inteligência, mas o barato de verdade continua sendo o MiMo-V2-Flash da Xiaomi.

Análise

Qwen3 Coder Next custa US$ 0,80 e bate Maverick em código

Modelo chinês de 3B ativos por token supera o multimodal da Meta em coding e agentic, com metade do preço de saída.

Retrospectiva

Semana fechou com 4 lançamentos e nenhum corte de preço

Qwen, Z.ai e MiniMax colocaram modelos novos. Quem já estava no catálogo não mexeu na etiqueta.

Análise

Qwen3 Coder Next cobra 4× mais caro que Nemotron Nano e entrega 2,5× mais código

Comparativo entre dois modelos MoE open-weight para coding agents: a conta da API e o que cada um realmente faz pelo seu agente.

Análise

Raciocínio custa caro: Xiaomi cobra US$ 0,30 e OpenAI cobra US$ 8 por milhão de tokens

Oito modelos de raciocínio no catálogo e a conta da API varia em 26 vezes entre o mais barato e o mais caro do recorte.

Análise

MiniMax M2.5 free chega com 200K de contexto e zero na fatura

Modelo chinês de produtividade estreia gratuito no catálogo um dia após o lançamento; ficha técnica sem preço nem benchmark publicado

Análise

Qwen3 Coder Next cobra 6× mais caro que gpt-oss-20b no token de saída

Dois modelos open weights com focos opostos: 75% a mais em coding para o chinês, um sexto do preço por milhão de tokens para o americano.

Análise

MiniMax M2.5 estreia sem benchmark público no catálogo

Modelo de produtividade e código entra a US$ 1,08 por milhão de tokens de saída, mas catálogo não publica IQ nem notas de coding ou agentic no dia do lançamento.

Lançamentos

MiniMax M2.5 chega a US$ 1,08 por milhão de saída para destronar o o3

A fabricante chinesa MiniMax aposta em preço baixo e contexto de 200 mil tokens para brigar com OpenAI, Anthropic e Xiaomi — mas o catálogo ainda não publicou índice de inteligência do modelo.

Análise

Z.ai lança GLM 5 a US$ 1,92 por milhão, mas sem benchmark de IQ

Modelo estreia mirando workflow agentic de longo prazo para programador sênior, mas o catálogo só publicou o preço — IQ, código e agentic seguem em branco.

Lançamentos

GLM 5 da Z.ai entra a US$ 1,92 sem nota de inteligência

Modelo flagship open-source da Z.ai chega com 204 mil tokens de contexto e preço intermediário; índice usado pelo catálogo ainda não tem medição para ele.

Análise

Qwen3 Coder Next: 27% mais barato e IQ 35% maior que o INTELLECT-3

Comparativo entre dois modelos MoE open-weight revela onde cada um entrega mais pelo token gasto e por que o americano ainda vale os 27% extras em tarefas que pedem raciocínio.

Análise

Janela de 1 milhão de tokens já tem 41 modelos — e o mais barato não é o melhor

O catálogo de modelos com contexto longo cresceu, mas pagar mais ainda não garante que o modelo pense melhor: o topo de inteligência do recorte está em outro lugar.

Análise

Qwen3 Max Thinking estreia a US$ 3,90 por milhão de saída: vale o que cobra?

Flagship de raciocínio da Qwen chega com contexto de 256k e preço agressivo, mas sem índice de inteligência publicado — o que pesa contra o3 e Claude Haiku 4.5.

Lançamentos

Qwen3 Max Thinking cobra metade do o3 — mas sem nota de IQ

Sem nota de inteligência publicada, a economia do novo modelo de raciocínio da Qwen é uma promessa, não uma conclusão.

Retrospectiva

Opus 4.6 a US$ 25, coder da Qwen a US$ 0,80: a semana em dois polos

Três lançamentos, nenhum corte de preço. Anthropic reforçou o polo premium; Qwen atacou o polo barato. O meio do mercado ficou parado.

← anteriores página 2 de 3 próximas →