Arquivo — 2026-03
61 reportagens neste mês.
Nemotron 3 Super cobra trinta vezes menos, mas sem índice de inteligência
Modelo aberto de 120B da NVIDIA sai por US$ 0,40 por milhão de tokens de saída; o catálogo ainda não publicou benchmark, então não dá para comparar diretamente com Gemini 3.1 Pro Preview nem GPT-5.3-Codex.
GPT-5.3 Chat cobra US$ 14 por milhão — o mesmo que o Codex, sem nota de QI
Lançado há oito dias, o modelo conversacional da OpenAI entra no catálogo sem medição de inteligência e disputa espaço com alternativas até 46 vezes mais baratas para o mesmo tipo de tarefa.
ByteDance Seed-2.0-Lite chega a US$ 2 de saída — sem nota de qualidade ainda
Modelo multimodal da ByteDance Seed custa um sexto do Gemini 3.1 Pro Preview, mas o catálogo ainda não publicou índice de inteligência, coding nem agentic.
Qwen3.5-9B batch custa US$ 0,25 por milhão de saída e mira volume
Versão batch do modelo de 9B parâmetros chega 67% mais barata que a edição padrão, mas sem índice de inteligência publicado
Qwen 3.5 122B custa menos da metade do Haiku 4.5 e tem IQ maior
O modelo chinês de pesos abertos vence em preço, contexto e velocidade — mas perde feio quando o assunto é honestidade sobre o que não sabe.
Gemini 3.1 Flash Lite Preview cobra US$ 1,50 por milhão — mas não tem QI
Versão econômica do Gemini 3.1 Pro custa oito vezes menos na saída, mas o índice de inteligência ainda está em branco no catálogo.
OpenAI despejou quatro modelos em três dias e o resto da semana ficou pequeno
GPT-5.4, GPT-5.4 Pro e duas variantes batch lideram os lançamentos de 2 a 8 de março, enquanto Gemini segue no topo do ranking de inteligência.
Nano Banana 2 cobra 4× menos que o Gemini Pro — e tem o mesmo contexto
O novo modelo de imagem do Google entra barato, mas a economia real depende de uma conta que pouca gente faz.
Qwen 3.5 122B cobra US$ 0,29 e empata com o3 em raciocínio
Modelo chinês aberto chega em fevereiro de 2026 cobrando quase 7 vezes menos por token de entrada do que o veterano da OpenAI.
MiMo-V2-Flash custa 8 vezes menos que a Qwen3.5-122B, mas só lê texto
Os dois são MoE chineses open-weights com reasoning. A diferença está no multimodal, nos benchmarks publicados e no preço de cache.
Qwen3.5-27B custa 1,56 dólar por milhão de saída e não tem nota de IQ
Modelo denso de 27B com visão e contexto de 262k chega barato, mas sem benchmark publicado — vale para quem roda alto volume e dispensa o topo do ranking.
Qwen3.5-Flash custa US$ 0,26 por milhão de saída — e não tem nota de inteligência
Lançado há oito dias, o modelo barato da Qwen chega sem benchmark público de IQ e precisa ser avaliado por eliminação, não por propaganda.
Qwen3.5-Flash cobra US$ 0,26 por milhão de saída: vale para o quê?
Modelo lançado há 8 dias pela Qwen chega barato, multimodal e com 1M de contexto — mas sem nota de inteligência publicada e sem rival direto no recorte.
Mercury 2 da Inception chega cobrando US$ 0,75 por milhão de saída
Modelo de difusão promete velocidade absurda, mas o índice de inteligência fica em 21,9 — abaixo de alternativas abertas bem mais baratas.
Mercury 2 da Inception sai por US$ 0,75 o milhão de saída e aposta em velocidade
É o primeiro LLM de raciocínio por difusão, mas o índice de inteligência de 21,9 coloca ele longe do topo do catálogo
GPT-5.3 Chat estreia a US$ 14/M, mesmo valor do Codex
A OpenAI não publicou IQ, coding nem agentic. A diferença na fatura está no cache, que cai a um décimo do preço de entrada.
GPT-5.3 Chat cobra US$ 14 por milhão de tokens de saída e entra sem nota de inteligência
Novo modelo da OpenAI para o dia a dia do ChatGPT chega caro, sem benchmark publicado e com o mesmo preço do Codex mais inteligente
Gemini Custom Tools cobra US$ 12/M e não publica benchmark
Variante do Gemini 3.1 Pro Preview, top-1 do IQ hoje. Sai pelo mesmo preço, mas sem score medido de código nem de agentic.
Qwen 3.5 397B custa 53% menos na saída e bate Haiku 4.5 no IQ
Modelo chinês de pesos abertos também vence em coding e agentic; cache de prompt ainda segura o Haiku em workloads repetitivos
10 modelos em 7 dias: a semana em que Qwen dominou os lançamentos
Quatro variantes da família Qwen3.5 entraram no catálogo entre 23 e 28 de fevereiro, enquanto OpenAI e Google brigaram pelo topo de preço.