FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (22)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-03

61 reportagens neste mês.

Lançamentos

Nemotron 3 Super cobra trinta vezes menos, mas sem índice de inteligência

Modelo aberto de 120B da NVIDIA sai por US$ 0,40 por milhão de tokens de saída; o catálogo ainda não publicou benchmark, então não dá para comparar diretamente com Gemini 3.1 Pro Preview nem GPT-5.3-Codex.

Análise

GPT-5.3 Chat cobra US$ 14 por milhão — o mesmo que o Codex, sem nota de QI

Lançado há oito dias, o modelo conversacional da OpenAI entra no catálogo sem medição de inteligência e disputa espaço com alternativas até 46 vezes mais baratas para o mesmo tipo de tarefa.

Lançamentos

ByteDance Seed-2.0-Lite chega a US$ 2 de saída — sem nota de qualidade ainda

Modelo multimodal da ByteDance Seed custa um sexto do Gemini 3.1 Pro Preview, mas o catálogo ainda não publicou índice de inteligência, coding nem agentic.

Lançamentos

Qwen3.5-9B batch custa US$ 0,25 por milhão de saída e mira volume

Versão batch do modelo de 9B parâmetros chega 67% mais barata que a edição padrão, mas sem índice de inteligência publicado

Análise

Qwen 3.5 122B custa menos da metade do Haiku 4.5 e tem IQ maior

O modelo chinês de pesos abertos vence em preço, contexto e velocidade — mas perde feio quando o assunto é honestidade sobre o que não sabe.

Análise

Gemini 3.1 Flash Lite Preview cobra US$ 1,50 por milhão — mas não tem QI

Versão econômica do Gemini 3.1 Pro custa oito vezes menos na saída, mas o índice de inteligência ainda está em branco no catálogo.

Retrospectiva

OpenAI despejou quatro modelos em três dias e o resto da semana ficou pequeno

GPT-5.4, GPT-5.4 Pro e duas variantes batch lideram os lançamentos de 2 a 8 de março, enquanto Gemini segue no topo do ranking de inteligência.

Análise

Nano Banana 2 cobra 4× menos que o Gemini Pro — e tem o mesmo contexto

O novo modelo de imagem do Google entra barato, mas a economia real depende de uma conta que pouca gente faz.

Análise

Qwen 3.5 122B cobra US$ 0,29 e empata com o3 em raciocínio

Modelo chinês aberto chega em fevereiro de 2026 cobrando quase 7 vezes menos por token de entrada do que o veterano da OpenAI.

Análise

MiMo-V2-Flash custa 8 vezes menos que a Qwen3.5-122B, mas só lê texto

Os dois são MoE chineses open-weights com reasoning. A diferença está no multimodal, nos benchmarks publicados e no preço de cache.

Análise

Qwen3.5-27B custa 1,56 dólar por milhão de saída e não tem nota de IQ

Modelo denso de 27B com visão e contexto de 262k chega barato, mas sem benchmark publicado — vale para quem roda alto volume e dispensa o topo do ranking.

Análise

Qwen3.5-Flash custa US$ 0,26 por milhão de saída — e não tem nota de inteligência

Lançado há oito dias, o modelo barato da Qwen chega sem benchmark público de IQ e precisa ser avaliado por eliminação, não por propaganda.

Análise

Qwen3.5-Flash cobra US$ 0,26 por milhão de saída: vale para o quê?

Modelo lançado há 8 dias pela Qwen chega barato, multimodal e com 1M de contexto — mas sem nota de inteligência publicada e sem rival direto no recorte.

Análise

Mercury 2 da Inception chega cobrando US$ 0,75 por milhão de saída

Modelo de difusão promete velocidade absurda, mas o índice de inteligência fica em 21,9 — abaixo de alternativas abertas bem mais baratas.

Lançamentos

Mercury 2 da Inception sai por US$ 0,75 o milhão de saída e aposta em velocidade

É o primeiro LLM de raciocínio por difusão, mas o índice de inteligência de 21,9 coloca ele longe do topo do catálogo

Lançamentos

GPT-5.3 Chat estreia a US$ 14/M, mesmo valor do Codex

A OpenAI não publicou IQ, coding nem agentic. A diferença na fatura está no cache, que cai a um décimo do preço de entrada.

Lançamentos

GPT-5.3 Chat cobra US$ 14 por milhão de tokens de saída e entra sem nota de inteligência

Novo modelo da OpenAI para o dia a dia do ChatGPT chega caro, sem benchmark publicado e com o mesmo preço do Codex mais inteligente

Análise

Gemini Custom Tools cobra US$ 12/M e não publica benchmark

Variante do Gemini 3.1 Pro Preview, top-1 do IQ hoje. Sai pelo mesmo preço, mas sem score medido de código nem de agentic.

Análise

Qwen 3.5 397B custa 53% menos na saída e bate Haiku 4.5 no IQ

Modelo chinês de pesos abertos também vence em coding e agentic; cache de prompt ainda segura o Haiku em workloads repetitivos

Retrospectiva

10 modelos em 7 dias: a semana em que Qwen dominou os lançamentos

Quatro variantes da família Qwen3.5 entraram no catálogo entre 23 e 28 de fevereiro, enquanto OpenAI e Google brigaram pelo topo de preço.

← anteriores página 3 de 4 próximas →