Quatro modelos estreiam no índice e custam menos de US$ 3 por milhão de tokens
Qwen3.8 2.4T A95B e três variantes do Gemini 3.7 Flash chegam à régua da Artificial Analysis com preços que apertam o meio do tabuleiro.
Quatro modelos entraram hoje no índice da Artificial Analysis, e três deles cobram US$ 1,50 por milhão de tokens de saída. É o menor preço já visto entre estreias com índice de inteligência acima de 50. O detalhe importa porque, até aqui, esse andar do ranking estava dominado por modelos entre US$ 6 e US$ 15 por milhão — e por um punhado de opções chinesas que já vinham forçando a régua para baixo.
O que entrou no índice hoje
A lista é curta e cirúrgica. A Alibaba/Qwen colocou o Qwen3.8 2.4T A95B na régua, com índice 57,7 e preço de US$ 3 por milhão de tokens de saída. O Google, por sua vez, publicou três variantes do Gemini 3.7 Flash — níveis high, medium e low — todas pelo mesmo US$ 1,50. Os índices: 56,0, 53,4 e 50,9, respectivamente.
| Modelo | Índice de inteligência | Preço combinado US$/M |
|---|---|---|
| Qwen3.8 2.4T A95B | 57.7 | 3.00 |
| Gemini 3.7 Flash (high) | 56.0 | 1.50 |
| Gemini 3.7 Flash (medium) | 53.4 | 1.50 |
| Gemini 3.7 Flash (low) | 50.9 | 1.50 |
Em outras palavras, o Google vendeu a mesma unidade de marca com três potências diferentes, no mesmo preço, e deixou o comprador escolher pelo teto de inteligência que precisa pagar.
Onde eles caem na régua
O topo segue intocado. Claude Opus 5 lidera com 63,1 e cobra US$ 25 por milhão. Claude Fable 5 vem logo atrás, em 62,1, cobrando o dobro do Opus. GPT-5.6 Sol fecha o pódio em 60,9, a US$ 10.
O Qwen3.8 2.4T A95B entra em 57,7 — acima do Grok 4.6 (60,9 é o quarto lugar, mas o Qwen fica a 3,2 pontos do terceiro colocado e a 5,4 do líder). Já o Gemini 3.7 Flash (high) entra em 56,0, encostando no Qwen, mas custando metade: US$ 1,50 contra US$ 3. As variantes medium e low vão caindo no índice conforme o nome sugere — 53,4 e 50,9 — sem mexer no preço.
O que isso aperta no meio do tabuleiro
A faixa entre 50 e 58 de índice é onde mora a maioria dos workloads de produção: classificação, sumarização, extração, agentes de primeira linha. Até hoje, quem buscava custo baixo nesse andar tinha o DeepSeek V4 Flash 0731 como referência — 51,8 de índice a US$ 0,18 por milhão, disparado o mais barato acima de IQ 45.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
O Gemini 3.7 Flash muda o cálculo. Pelo mesmo preço do DeepSeek? Não — o Gemini custa oito vezes mais. Mas entrega entre 5 e 6 pontos a mais de índice. É a diferença entre um modelo que você usa para rascunho e um que você confia para entregar ao cliente. Já o Qwen3.8, a US$ 3, senta entre os dois: paga-se 17 vezes o DeepSeek, mas ganha-se 6 pontos de índice e ainda fica 60% mais barato que o GPT-5.6 Sol.
Para quem cada um vale — e para quem não muda nada
Se você roda alto volume de tarefas simples e o índice 51 já resolve, o DeepSeek V4 Flash 0731 continua imbatível em custo. O Gemini 3.7 Flash (low), a 50,9 por US$ 1,50, só faz sentido se você precisa especificamente da API do Google — por exemplo, integração com Vertex AI, multimodal nativo ou residência de dados.
Se você quer subir a régua sem estourar a conta, o Gemini 3.7 Flash (high) a US$ 1,50 é a estreia mais agressiva do dia: índice 56 a preço de commodity. O Qwen3.8 2.4T A95B, a US$ 3, é para quem prefere o ecossistema open-weight da Alibaba ou já tem pipeline afinado em Qwen.
Se você está no andar de cima — Opus 5, Fable 5, GPT-5.6 Sol — nada disso te alcança. A diferença de 6 a 7 pontos de índice não se compra com US$ 1,50; compra-se com raciocínio, e essa conta continua salgada.
O tabuleiro em uma frase
Em 14 de agosto de 2026, o catálogo da Artificial Analysis soma mais de 549 modelos de 68 criadores, com 47 lançamentos nos últimos 30 dias. As estreias de hoje não derrubam o topo — mas empurram o chão para baixo. Quem paga a API em produção tem, pela primeira vez, três opções acima de IQ 50 abaixo de US$ 3 por milhão de tokens de saída.
Se seu workload vive na faixa de IQ 50–56, vale trocar hoje para Gemini 3.7 Flash (high) ou Qwen3.8 2.4T A95B antes de renovar contrato — o custo por milhão caiu sem você perder qualidade mensurável.
Perguntas frequentes
Quanto custa o Gemini 3.7 Flash por milhão de tokens?
As três variantes do Gemini 3.7 Flash custam US$ 1,50 por milhão de tokens de saída, segundo a Artificial Analysis. O índice varia: 56,0 (high), 53,4 (medium) e 50,9 (low).
O Qwen3.8 2.4T A95B é melhor que o Claude Opus 5?
Não. O Qwen3.8 2.4T A95B entra com índice 57,7 e preço de US$ 3 por milhão; o Claude Opus 5 lidera com 63,1 e custa US$ 25 por milhão. A diferença de 5,4 pontos de índice é o que separa o topo do meio do tabuleiro.
Qual modelo estreou mais barato acima de IQ 50 hoje?
O Gemini 3.7 Flash (low), a US$ 1,50 por milhão de tokens de saída com índice 50,9. O DeepSeek V4 Flash 0731 segue mais barato no catálogo geral (US$ 0,18), mas não estreou hoje.