Arquivo — 2026-03
61 reportagens neste mês.
MiMo-V2-Omni e Qwen3.5 397B custam quase igual — só um lê áudio
Xiaomi e Qwen ocupam a mesma faixa de US$ 2 por milhão na saída e ficam a 1,6 ponto de QI. O que decide está nas linhas que o release não destaca.
MiMo-V2-Omni a US$ 2 contra Qwen3.5 397B: áudio nativo ou pesos abertos
A escolha não passa por inteligência — os dois ficam na faixa IQ 35 e custam quase o mesmo. Passa pelo tipo de problema: multimodal com áudio versus open weights MoE que roda na sua máquina.
Qwen3.5-9B a US$ 0,15 o milhão e ainda sem nota de IQ
Multimodal de 9B parâmetros da Qwen entra na régua do preço baixo. Dez dias depois do lançamento, falta o número que diz quanto ele acerta.
Reka Edge entra no catálogo por US$ 0,10 por milhão de tokens
Modelo da Reka AI aceita vídeo, cobra o mesmo preço na entrada e na saída, e ainda não tem benchmark independente de inteligência publicado.
MiMo-V2-Omni cobra 1/7 do Sonnet 4.6 e quase empata em inteligência
Omni-modal chinês a US$ 2 por milhão de saída versus o modelo da Anthropic a US$ 15. A diferença pesa na fatura mais do que no benchmark.
MiMo-V2-Omni é o único do top 5 que processa áudio por US$ 2
O modelo é o terceiro mais inteligente do catálogo e o mais barato entre os cinco primeiros. Serve para áudio nativo, não para o topo absoluto de raciocínio.
MiniMax M2.7 entra a US$ 1,20 por milhão, mas sem IQ publicado
Principal custa 10× menos que o Gemini 3.1 Pro Preview na saída; benchmark de inteligência, coding e agentic ficaram fora da ficha de lançamento.
MiniMax M2.7 chega por US$ 1,20 por milhão de tokens de saída
Modelo chinês foca em agentes autônomos e cobra 10 vezes menos que Gemini 3.1 Pro e GPT-5.3-Codex, mas ainda sem nota de inteligência publicada
GPT-5.4 Mini sai por um terço do Codex — mas sem nota de inteligência
O novo modelo da OpenAI chega com tabela agressiva e janela de 400 mil tokens, mas a empresa não publicou índice de inteligência, benchmark de código nem velocidade.
GPT-5.4 Pro batch cobra US$ 90 por milhão de saída — vale o selo Pro?
Versão em lote do modelo mais caro da OpenAI chega 12 dias depois do lançamento com janela de 1M de tokens e preço que exige olhar fino.
Mistral Small 4 custa US$ 0,60 por milhão de saída e mira no meio do pacote
Modelo aberto de 119B parâmetros chega com IQ 19,7 e preço 20 vezes menor que o topo da tabela — útil para quem não precisa do melhor raciocínio.
Mistral Small 4 custa 3,5x mais que o gpt-oss-120b e tem IQ menor
Visão, cache barato e bandeira francesa. Mas o gpt-oss-120b faz mais por uma fração do preço.
GLM 5 Turbo da Z.ai cobra US$ 4 por milhão de saída e entra sem nota de inteligência
Modelo chinês focado em agentes chega a US$ 1,20 de entrada e US$ 0,24 de cache, mas o catálogo ainda não publicou índice de capacidade.
Seis lançamentos em sete dias, todos abaixo de US$ 5 por milhão de saída
A semana foi dominada por modelos pequenos e baratos da China e dos EUA, sem corte de preço nem mudança de tabela — o movimento está no catálogo.
Haiku 4.5 custa quase 7× mais caro que Mercury 2 no token de saída
Quase seis meses separam os dois lançamentos da Anthropic e da Inception — e a conta de API mostra quem paga pelo silêncio do raciocínio.
Haiku 4.5 custa US$ 5 por milhão de saída; Mercury 2 cobra US$ 0,75
Comparativo frente a frente entre o modelo eficiente da Anthropic e a primeira dLLM de raciocínio da Inception, lançada dez dias atrás.
Haiku 4.5 cobra 4× mais que o Qwen 3.5-35B e lidera em código
A diferença é 5,6 pontos no índice geral e 6,9 no benchmark de código. O Haiku também tem raciocínio. O Qwen cobra um quarto, roda quase o dobro da velocidade e abre os pesos.
GPT-5.4 batch a US$ 7,50: o que falta provar
A versão em lote une as linhas GPT e Codex, com 1.050.000 tokens de contexto e US$ 7,50 por milhão na saída. Sem índice de inteligência ou métricas de coding e agentic, preço ainda não é evidência de qualidade.
GPT-5.4 custa US$ 15 por milhão de saída — e a conta não é o que parece
A OpenAI unificou as linhas Codex e GPT em um único modelo com contexto de 1M+ tokens. A questão é se vale migrar do Sonnet 4.6 ou do Gemini 3.1 Pro Preview.
o3 custa 6 vezes mais que o Qwen3.5-35B e entrega 28% mais IQ
Comparativo frente a frente entre o modelo de raciocínio da OpenAI e o MoE chinês de 35B, com a conta de quem paga a API no fim.