FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-03

61 reportagens neste mês.

Análise

MiniMax M2.7 chega a US$ 1,20 por milhão de saída — mas sem nota de QI

Modelo novo da MiniMax aposta em preço baixo e contexto longo; a dúvida é o que ele entrega de fato quando ninguém publicou benchmark.

Análise

MiniMax M2.7 custa um terço do Gemini 3.1 Pro — mas não aparece no topo do ranking

Lançado há 13 dias, o modelo da MiniMax tem preço de intermediário e contexto de 200 mil tokens; o problema é que ninguém mediu a inteligência dele ainda.

Análise

GPT-5.4 Nano custa 11x menos que o Codex — e não tem nota de QI

O catálogo lista preço, contexto e modalidade do modelo da OpenAI, mas deixou vazios os campos de inteligência. Veja quando vale rotear volume para ele e quando o barato sai caro.

Lançamentos

Google lança Lyria 3 em prévia gratuita: 30 segundos de música por US$ 0,04

Modelo de geração de áudio chega pela API do Gemini com dois variantes e precificação por clipe, não por token.

Análise

GPT-5.4 Nano cobra um décimo do Codex: vale trocar?

Versão leve da família 5.4 chega em modo batch com preço agressivo, mas a OpenAI não publicou índice de inteligência — e isso muda o cálculo.

Retrospectiva

Semana de um lançamento só e preço tabelado no topo

Entre 23 e 29 de março, só a Kwaipilot entrou no catálogo; Gemini e GPT seguem isolados acima de IQ 45.

Análise

GPT-5.4 Mini custa um terço do Codex — e o catálogo não cravou IQ

Lançado em 17 de março, o modelo mini da OpenAI tem preço, contexto e cache publicados, mas ainda não tem nota de inteligência. O que isso muda para quem escolhe modelo pela fatura.

Análise

Mercury 2 é 4× mais rápido e mais barato que o Qwen 3.5 35B-A3B

O modelo da Inception entrega 669 tokens por segundo e cache 10× mais barato. O Qwen responde com multimodal, pesos abertos e um índice de inteligência 11% maior.

Análise

GPT-5.4 Mini batch: barato de verdade, mas sem nota de IQ

É o ponto mais barato da família GPT-5 — desde que você tope esperar horas pela resposta e decidir sem benchmark.

Lançamentos

KAT-Coder-Pro V2 cobra 12 vezes menos que o Codex — mas sem nota de IQ

Lançamento da Kwaipilot entra no catálogo a US$ 1,20 por milhão de tokens de saída e não aparece nos rankings de inteligência da Artificial Analysis.

Análise

Qwen 3.5 35B-A3B cobra 7 vezes mais que o gpt-oss-120b com o mesmo QI

Os dois são modelos abertos que empatam no índice de inteligência mas têm contas 7 vezes diferentes na saída. Modalidade, janela de contexto e modo de raciocínio decidem quando vale pagar mais.

Análise

Mistral Small 4 batch custa US$ 0,30 por milhão de saída: vale trocar?

Lançado há dez dias, o modelo de Mistral chega com preço agressivo e contexto de 262 mil tokens — mas sem nota de inteligência publicada e com a turma de elite bem na frente.

Análise

Xiaomi MiMo-V2-Omni cobra 60% menos que Claude Haiku 4.5 — vale a troca?

Omni da Xiaomi custa US$ 2 por milhão de saída contra US$ 5 do Haiku 4.5; a diferença aparece no índice de inteligência e na modalidade.

Análise

GLM 5 Turbo chega a US$ 4 por milhão de saída, mas sem nota de IQ

Dez dias após o lançamento, o modelo da Z.ai aposta em preço baixo e janela de contexto grande — só que o catálogo ainda não tem benchmark para mostrar.

Análise

NVIDIA Nemotron 3 Super é grátis, mas não publica nota de IQ

Modelo aberto aciona só 12B dos 120B a cada token. Contexto de 262 mil cabe numa conta que custa zero.

Análise

Omni da Xiaomi custa 75% menos que o o3 e entrega mais inteligência

MiMo-V2-Omni estreou há seis dias cobrando US$ 2 por milhão de saída enquanto o o3, com quase um ano de casa, cobra US$ 8 — e ainda perde em benchmark.

Análise

MiMo-V2-Omni a US$ 2 ou Qwen3.5-122B a US$ 2,40? O que cada chinês de março entrega por esse preço

Dois modelos chineses lançados em fevereiro e março disputam a faixa de preço mais barata do catálogo — um é multimodal nativo, o outro é aberto e tem benchmark de código.

Análise

MiMo-V2-Omni cobra US$ 2 por milhão e bate Qwen3.5-122B em inteligência

Dois modelos chineses lançados em fevereiro e março disputam o mesmo nicho multimodal — e a conta da API sai diferente.

Análise

Seed-2.0-Lite da ByteDance custa um sexto do Gemini Pro

Modelo multimodal de 262 mil tokens entra no catálogo a US$ 0,25 por milhão de entrada — mas sem índice de inteligência publicado, a comparação com o topo da tabela fica em outra moeda.

Retrospectiva

Onze modelos novos em sete dias, zero corte de preço

Quem lançou mirou em centavos, e o topo do ranking segue trancado para Google e OpenAI.

página 1 de 4 próximas →