FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-02

55 reportagens neste mês.

Análise

Qwen3.5-35B-A3B: 3 bilhões ativos cobrando US$ 1,25 por milhão de saída

Modelo chinês de pesos abertos chega três dias depois do irmão maior e mira o mesmo nicho barato — mas com multimodalidade nativa e contexto de 256K.

Análise

Sonnet 4.6 cobra US$ 15 por milhão. O Qwen 3.5 faz o mesmo por US$ 2,40

Frente a frente entre o modelo mais capaz da Anthropic agora e um chinês open weights que custa um sexto — e processa vídeo.

Análise

Qwen3.5 122B cobra US$ 2,40 por milhão de saída e mira o Haiku 4.5

Modelo chinês open-weights de 125B parâmetros chega dois dias depois do irmão maior e fica entre o MiMo da Xiaomi e o Haiku da Anthropic no radar de preço.

Análise

Gemini 3.1 Pro Preview cobra US$ 12 por milhão e lidera o ranking; GPT-5.3-Codex cobra US$ 14 e promete mais código

Dois modelos americanos no topo da tabela de inteligência em fevereiro de 2026 — e a diferença está no preço, na janela de contexto e no que cada um faz melhor.

Lançamentos

Seed-2.0-Mini da ByteDance entra a US$ 0,40 por milhão de tokens de saída

Modelo multimodal de 256k de contexto chega mais barato que o MiMo-V2-Flash da Xiaomi e promete rivalizar com o Seed-1.6 — mas sem nota de inteligência publicada.

Lançamentos

Nano Banana 2 cobra 75% menos que o Gemini Pro Preview para gerar imagem

Novo modelo de imagem do Google entra no catálogo a US$ 3 por milhão de tokens de saída, mas sem nota de inteligência publicada.

Lançamentos

Gemini 3.1 Pro ganha versão que gasta menos ferramenta: o que muda na fatura

Mesma janela de contexto, mesmo preço de saída do Pro padrão — a diferença está em como o modelo decide chamar ferramentas externas.

Lançamentos

GPT-5.3-Codex chega caro e mira o topo do Gemini

OpenAI lança hoje o sucessor do Codex a US$ 14 por milhão de tokens de saída e fica atrás do Gemini 3.1 Pro Preview no índice de inteligência.

Análise

GPT-5.3-Codex chega a US$ 14 por milhão e fica abaixo do Gemini em inteligência

OpenAI posiciona o modelo como o mais avançado para coding agentico, mas a conta de saída sai US$ 2 mais cara que a do rival do Google — e o argumento de venda está no cache e na velocidade.

Análise

Qwen3.5 397B custa um terço do o3 e empata em raciocínio

Modelo chinês de 17B ativos chega ao catálogo com preço de commodity e benchmark de peso pesado — o que muda na sua fila de produção.

Lançamentos

Aion-2.0 entra a US$ 1,60 por milhão de tokens sem benchmark de inteligência

Variante do DeepSeek V3.2 para roleplay é 87% mais barata que o Gemini 3.1 Pro Preview, mas sem nota de IQ não dá para colocar no gráfico de custo-benefício.

Análise

Quase o mesmo QI, conta oito vezes menor

Qwen3.5 397B e MiMo-V2-Flash empatam em inteligência no catálogo, mas a diferença de preço e de recursos multimodais define quem leva cada tarefa.

Análise

Qwen 3.5 397B e MiMo-V2-Flash empatam em QI, mas a conta sai 7,8x maior

Dois modelos chineses open-weights com 34 pontos de inteligência e arquitetura híbrida. Um cobra US$ 2,34 por milhão de tokens de saída; o outro, US$ 0,30.

Análise

Sonnet 4.6 cobra 87% a mais que o3 por 4 pontos de IQ

Lançado há quatro dias, modelo da Anthropic tem contexto cinco vezes maior e entrega 2,6 vezes mais devagar que o o3, da OpenAI.

Análise

Gemini 3.1 Pro em modo batch custa metade — e ninguém está olhando

A versão assíncrona do topo do catálogo da Google sai por US$ 6 por milhão de tokens de saída, mas exige esperar horas.

Análise

Sonnet 4.6 custa 50 vezes mais que MiMo-V2-Flash; vale a diferença?

Comparativo frente a frente entre o modelo da Anthropic e o MoE open-weights da Xiaomi, com índice de inteligência, contexto e preço na ponta do lápis.

Análise

Sonnet 4.6 batch: o mesmo modelo por 40% menos, com uma fila no meio

A Anthropic cortou o preço do Claude Sonnet 4.6 na fila batch três dias após o lançamento. O que muda no seu pipeline e o que continua igual.

Análise

Gemini 3.1 Pro Preview estreia a US$ 12 por milhão de saída

Frente reasoning da Google custa o mesmo que o o3 da OpenAI e desbota a vantagem de preço que a Anthropic vinha mostrando.

Lançamentos

Gemini 3.1 Pro Preview cobra US$ 12 por milhão e lidera ranking de inteligência

É o modelo mais caro entre os cinco primeiros do catálogo, mas também o único acima de IQ 45 — e a diferença é grande.

Análise

Sonnet 4.6 lidera em IQ, mas cobra 6,4× mais caro que Qwen 3.5

Lançados com 48 horas de diferença, os dois modelos disputam o topo de um catálogo de 338 com propostas opostas: fechado nos EUA a US$ 15 por milhão de tokens de saída, ou pesos abertos na China a US$ 2,34.

página 1 de 3 próximas →