FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-03

61 reportagens neste mês.

Análise

MiMo-V2-Omni e Qwen3.5 397B custam quase igual — só um lê áudio

Xiaomi e Qwen ocupam a mesma faixa de US$ 2 por milhão na saída e ficam a 1,6 ponto de QI. O que decide está nas linhas que o release não destaca.

Análise

MiMo-V2-Omni a US$ 2 contra Qwen3.5 397B: áudio nativo ou pesos abertos

A escolha não passa por inteligência — os dois ficam na faixa IQ 35 e custam quase o mesmo. Passa pelo tipo de problema: multimodal com áudio versus open weights MoE que roda na sua máquina.

Análise

Qwen3.5-9B a US$ 0,15 o milhão e ainda sem nota de IQ

Multimodal de 9B parâmetros da Qwen entra na régua do preço baixo. Dez dias depois do lançamento, falta o número que diz quanto ele acerta.

Lançamentos

Reka Edge entra no catálogo por US$ 0,10 por milhão de tokens

Modelo da Reka AI aceita vídeo, cobra o mesmo preço na entrada e na saída, e ainda não tem benchmark independente de inteligência publicado.

Análise

MiMo-V2-Omni cobra 1/7 do Sonnet 4.6 e quase empata em inteligência

Omni-modal chinês a US$ 2 por milhão de saída versus o modelo da Anthropic a US$ 15. A diferença pesa na fatura mais do que no benchmark.

Análise

MiMo-V2-Omni é o único do top 5 que processa áudio por US$ 2

O modelo é o terceiro mais inteligente do catálogo e o mais barato entre os cinco primeiros. Serve para áudio nativo, não para o topo absoluto de raciocínio.

Lançamentos

MiniMax M2.7 entra a US$ 1,20 por milhão, mas sem IQ publicado

Principal custa 10× menos que o Gemini 3.1 Pro Preview na saída; benchmark de inteligência, coding e agentic ficaram fora da ficha de lançamento.

Lançamentos

MiniMax M2.7 chega por US$ 1,20 por milhão de tokens de saída

Modelo chinês foca em agentes autônomos e cobra 10 vezes menos que Gemini 3.1 Pro e GPT-5.3-Codex, mas ainda sem nota de inteligência publicada

Lançamentos

GPT-5.4 Mini sai por um terço do Codex — mas sem nota de inteligência

O novo modelo da OpenAI chega com tabela agressiva e janela de 400 mil tokens, mas a empresa não publicou índice de inteligência, benchmark de código nem velocidade.

Análise

GPT-5.4 Pro batch cobra US$ 90 por milhão de saída — vale o selo Pro?

Versão em lote do modelo mais caro da OpenAI chega 12 dias depois do lançamento com janela de 1M de tokens e preço que exige olhar fino.

Lançamentos

Mistral Small 4 custa US$ 0,60 por milhão de saída e mira no meio do pacote

Modelo aberto de 119B parâmetros chega com IQ 19,7 e preço 20 vezes menor que o topo da tabela — útil para quem não precisa do melhor raciocínio.

Análise

Mistral Small 4 custa 3,5x mais que o gpt-oss-120b e tem IQ menor

Visão, cache barato e bandeira francesa. Mas o gpt-oss-120b faz mais por uma fração do preço.

Lançamentos

GLM 5 Turbo da Z.ai cobra US$ 4 por milhão de saída e entra sem nota de inteligência

Modelo chinês focado em agentes chega a US$ 1,20 de entrada e US$ 0,24 de cache, mas o catálogo ainda não publicou índice de capacidade.

Retrospectiva

Seis lançamentos em sete dias, todos abaixo de US$ 5 por milhão de saída

A semana foi dominada por modelos pequenos e baratos da China e dos EUA, sem corte de preço nem mudança de tabela — o movimento está no catálogo.

Preços

Haiku 4.5 custa quase 7× mais caro que Mercury 2 no token de saída

Quase seis meses separam os dois lançamentos da Anthropic e da Inception — e a conta de API mostra quem paga pelo silêncio do raciocínio.

Análise

Haiku 4.5 custa US$ 5 por milhão de saída; Mercury 2 cobra US$ 0,75

Comparativo frente a frente entre o modelo eficiente da Anthropic e a primeira dLLM de raciocínio da Inception, lançada dez dias atrás.

Análise

Haiku 4.5 cobra 4× mais que o Qwen 3.5-35B e lidera em código

A diferença é 5,6 pontos no índice geral e 6,9 no benchmark de código. O Haiku também tem raciocínio. O Qwen cobra um quarto, roda quase o dobro da velocidade e abre os pesos.

Análise

GPT-5.4 batch a US$ 7,50: o que falta provar

A versão em lote une as linhas GPT e Codex, com 1.050.000 tokens de contexto e US$ 7,50 por milhão na saída. Sem índice de inteligência ou métricas de coding e agentic, preço ainda não é evidência de qualidade.

Análise

GPT-5.4 custa US$ 15 por milhão de saída — e a conta não é o que parece

A OpenAI unificou as linhas Codex e GPT em um único modelo com contexto de 1M+ tokens. A questão é se vale migrar do Sonnet 4.6 ou do Gemini 3.1 Pro Preview.

Análise

o3 custa 6 vezes mais que o Qwen3.5-35B e entrega 28% mais IQ

Comparativo frente a frente entre o modelo de raciocínio da OpenAI e o MoE chinês de 35B, com a conta de quem paga a API no fim.

← anteriores página 2 de 4 próximas →