Análise
396 reportagens de análise sobre modelos de inteligência artificial.
GPT-5.4 Mini batch: barato de verdade, mas sem nota de IQ
É o ponto mais barato da família GPT-5 — desde que você tope esperar horas pela resposta e decidir sem benchmark.
Qwen 3.5 35B-A3B cobra 7 vezes mais que o gpt-oss-120b com o mesmo QI
Os dois são modelos abertos que empatam no índice de inteligência mas têm contas 7 vezes diferentes na saída. Modalidade, janela de contexto e modo de raciocínio decidem quando vale pagar mais.
Mistral Small 4 batch custa US$ 0,30 por milhão de saída: vale trocar?
Lançado há dez dias, o modelo de Mistral chega com preço agressivo e contexto de 262 mil tokens — mas sem nota de inteligência publicada e com a turma de elite bem na frente.
Xiaomi MiMo-V2-Omni cobra 60% menos que Claude Haiku 4.5 — vale a troca?
Omni da Xiaomi custa US$ 2 por milhão de saída contra US$ 5 do Haiku 4.5; a diferença aparece no índice de inteligência e na modalidade.
GLM 5 Turbo chega a US$ 4 por milhão de saída, mas sem nota de IQ
Dez dias após o lançamento, o modelo da Z.ai aposta em preço baixo e janela de contexto grande — só que o catálogo ainda não tem benchmark para mostrar.
Omni da Xiaomi custa 75% menos que o o3 e entrega mais inteligência
MiMo-V2-Omni estreou há seis dias cobrando US$ 2 por milhão de saída enquanto o o3, com quase um ano de casa, cobra US$ 8 — e ainda perde em benchmark.
NVIDIA Nemotron 3 Super é grátis, mas não publica nota de IQ
Modelo aberto aciona só 12B dos 120B a cada token. Contexto de 262 mil cabe numa conta que custa zero.
MiMo-V2-Omni cobra US$ 2 por milhão e bate Qwen3.5-122B em inteligência
Dois modelos chineses lançados em fevereiro e março disputam o mesmo nicho multimodal — e a conta da API sai diferente.
MiMo-V2-Omni a US$ 2 ou Qwen3.5-122B a US$ 2,40? O que cada chinês de março entrega por esse preço
Dois modelos chineses lançados em fevereiro e março disputam a faixa de preço mais barata do catálogo — um é multimodal nativo, o outro é aberto e tem benchmark de código.
Seed-2.0-Lite da ByteDance custa um sexto do Gemini Pro
Modelo multimodal de 262 mil tokens entra no catálogo a US$ 0,25 por milhão de entrada — mas sem índice de inteligência publicado, a comparação com o topo da tabela fica em outra moeda.
MiMo-V2-Omni a US$ 2 contra Qwen3.5 397B: áudio nativo ou pesos abertos
A escolha não passa por inteligência — os dois ficam na faixa IQ 35 e custam quase o mesmo. Passa pelo tipo de problema: multimodal com áudio versus open weights MoE que roda na sua máquina.
MiMo-V2-Omni e Qwen3.5 397B custam quase igual — só um lê áudio
Xiaomi e Qwen ocupam a mesma faixa de US$ 2 por milhão na saída e ficam a 1,6 ponto de QI. O que decide está nas linhas que o release não destaca.
Qwen3.5-9B a US$ 0,15 o milhão e ainda sem nota de IQ
Multimodal de 9B parâmetros da Qwen entra na régua do preço baixo. Dez dias depois do lançamento, falta o número que diz quanto ele acerta.
MiMo-V2-Omni cobra 1/7 do Sonnet 4.6 e quase empata em inteligência
Omni-modal chinês a US$ 2 por milhão de saída versus o modelo da Anthropic a US$ 15. A diferença pesa na fatura mais do que no benchmark.
MiMo-V2-Omni é o único do top 5 que processa áudio por US$ 2
O modelo é o terceiro mais inteligente do catálogo e o mais barato entre os cinco primeiros. Serve para áudio nativo, não para o topo absoluto de raciocínio.
GPT-5.4 Pro batch cobra US$ 90 por milhão de saída — vale o selo Pro?
Versão em lote do modelo mais caro da OpenAI chega 12 dias depois do lançamento com janela de 1M de tokens e preço que exige olhar fino.
Mistral Small 4 custa 3,5x mais que o gpt-oss-120b e tem IQ menor
Visão, cache barato e bandeira francesa. Mas o gpt-oss-120b faz mais por uma fração do preço.
Haiku 4.5 custa US$ 5 por milhão de saída; Mercury 2 cobra US$ 0,75
Comparativo frente a frente entre o modelo eficiente da Anthropic e a primeira dLLM de raciocínio da Inception, lançada dez dias atrás.
Haiku 4.5 cobra 4× mais que o Qwen 3.5-35B e lidera em código
A diferença é 5,6 pontos no índice geral e 6,9 no benchmark de código. O Haiku também tem raciocínio. O Qwen cobra um quarto, roda quase o dobro da velocidade e abre os pesos.
GPT-5.4 batch a US$ 7,50: o que falta provar
A versão em lote une as linhas GPT e Codex, com 1.050.000 tokens de contexto e US$ 7,50 por milhão na saída. Sem índice de inteligência ou métricas de coding e agentic, preço ainda não é evidência de qualidade.