Arquivo — 2026-03
61 reportagens neste mês.
MiniMax M2.7 chega a US$ 1,20 por milhão de saída — mas sem nota de QI
Modelo novo da MiniMax aposta em preço baixo e contexto longo; a dúvida é o que ele entrega de fato quando ninguém publicou benchmark.
MiniMax M2.7 custa um terço do Gemini 3.1 Pro — mas não aparece no topo do ranking
Lançado há 13 dias, o modelo da MiniMax tem preço de intermediário e contexto de 200 mil tokens; o problema é que ninguém mediu a inteligência dele ainda.
GPT-5.4 Nano custa 11x menos que o Codex — e não tem nota de QI
O catálogo lista preço, contexto e modalidade do modelo da OpenAI, mas deixou vazios os campos de inteligência. Veja quando vale rotear volume para ele e quando o barato sai caro.
Google lança Lyria 3 em prévia gratuita: 30 segundos de música por US$ 0,04
Modelo de geração de áudio chega pela API do Gemini com dois variantes e precificação por clipe, não por token.
GPT-5.4 Nano cobra um décimo do Codex: vale trocar?
Versão leve da família 5.4 chega em modo batch com preço agressivo, mas a OpenAI não publicou índice de inteligência — e isso muda o cálculo.
Semana de um lançamento só e preço tabelado no topo
Entre 23 e 29 de março, só a Kwaipilot entrou no catálogo; Gemini e GPT seguem isolados acima de IQ 45.
GPT-5.4 Mini custa um terço do Codex — e o catálogo não cravou IQ
Lançado em 17 de março, o modelo mini da OpenAI tem preço, contexto e cache publicados, mas ainda não tem nota de inteligência. O que isso muda para quem escolhe modelo pela fatura.
Mercury 2 é 4× mais rápido e mais barato que o Qwen 3.5 35B-A3B
O modelo da Inception entrega 669 tokens por segundo e cache 10× mais barato. O Qwen responde com multimodal, pesos abertos e um índice de inteligência 11% maior.
GPT-5.4 Mini batch: barato de verdade, mas sem nota de IQ
É o ponto mais barato da família GPT-5 — desde que você tope esperar horas pela resposta e decidir sem benchmark.
KAT-Coder-Pro V2 cobra 12 vezes menos que o Codex — mas sem nota de IQ
Lançamento da Kwaipilot entra no catálogo a US$ 1,20 por milhão de tokens de saída e não aparece nos rankings de inteligência da Artificial Analysis.
Qwen 3.5 35B-A3B cobra 7 vezes mais que o gpt-oss-120b com o mesmo QI
Os dois são modelos abertos que empatam no índice de inteligência mas têm contas 7 vezes diferentes na saída. Modalidade, janela de contexto e modo de raciocínio decidem quando vale pagar mais.
Mistral Small 4 batch custa US$ 0,30 por milhão de saída: vale trocar?
Lançado há dez dias, o modelo de Mistral chega com preço agressivo e contexto de 262 mil tokens — mas sem nota de inteligência publicada e com a turma de elite bem na frente.
Xiaomi MiMo-V2-Omni cobra 60% menos que Claude Haiku 4.5 — vale a troca?
Omni da Xiaomi custa US$ 2 por milhão de saída contra US$ 5 do Haiku 4.5; a diferença aparece no índice de inteligência e na modalidade.
GLM 5 Turbo chega a US$ 4 por milhão de saída, mas sem nota de IQ
Dez dias após o lançamento, o modelo da Z.ai aposta em preço baixo e janela de contexto grande — só que o catálogo ainda não tem benchmark para mostrar.
NVIDIA Nemotron 3 Super é grátis, mas não publica nota de IQ
Modelo aberto aciona só 12B dos 120B a cada token. Contexto de 262 mil cabe numa conta que custa zero.
Omni da Xiaomi custa 75% menos que o o3 e entrega mais inteligência
MiMo-V2-Omni estreou há seis dias cobrando US$ 2 por milhão de saída enquanto o o3, com quase um ano de casa, cobra US$ 8 — e ainda perde em benchmark.
MiMo-V2-Omni a US$ 2 ou Qwen3.5-122B a US$ 2,40? O que cada chinês de março entrega por esse preço
Dois modelos chineses lançados em fevereiro e março disputam a faixa de preço mais barata do catálogo — um é multimodal nativo, o outro é aberto e tem benchmark de código.
MiMo-V2-Omni cobra US$ 2 por milhão e bate Qwen3.5-122B em inteligência
Dois modelos chineses lançados em fevereiro e março disputam o mesmo nicho multimodal — e a conta da API sai diferente.
Seed-2.0-Lite da ByteDance custa um sexto do Gemini Pro
Modelo multimodal de 262 mil tokens entra no catálogo a US$ 0,25 por milhão de entrada — mas sem índice de inteligência publicado, a comparação com o topo da tabela fica em outra moeda.
Onze modelos novos em sete dias, zero corte de preço
Quem lançou mirou em centavos, e o topo do ranking segue trancado para Google e OpenAI.