FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

DeepSeek V4 Flash Vision estreia a US$ 0,66 e empurra o índice de inteligência

Qwen3.8 27B entra junto, mas fica longe do pelotão intermediário. Enquanto isso, Claude Opus 5 segue no topo a US$ 25 por milhão de tokens.

Redação FalaVIP IA 3 min de leitura
US$ 0,66por milhão de tokens de saída do DeepSeek V4 Flash Vision
IQ 51,47índice do DeepSeek V4 Flash Vision no Artificial Analysis
US$ 25preço por milhão de tokens de saída do Claude Opus 5, atual líder

Dois modelos chineses, dois pontos muito diferentes da régua

Dois modelos chineses entraram hoje no índice do Artificial Analysis, e a distância entre eles é o que chama atenção. O DeepSeek V4 Flash Vision (Reasoning, Max Effort) cravou IQ 51,47 e custa US$ 0,66 por milhão de tokens de saída. O Qwen3.8 27B (Non-reasoning) ficou em IQ 34,74 e sai por US$ 1,125. Mesmo pagando quase o dobro, o Qwen entrega menos inteligência por dólar. É o tipo de estreia que faz você repensar a tentação de escolher só pelo nome do criador.

Índice de inteligência das estreias
DeepSeek V4 Flash Vision (Re51,5Qwen3.8 27B (Non-reasoning)34,7índice

Onde eles caem no tabuleiro

O catálogo do Artificial Analysis soma hoje 557 modelos ativos vindos de 70 criadores — e esse número é um piso, porque modelos removidos depois somem da lista. Para situar as estreias, vale olhar quem está no topo agora: Claude Opus 5 lidera com IQ 63,05 a US$ 25 por milhão de tokens de saída, seguido de Claude Fable 5 (IQ 62,07, US$ 50) e GPT-5.6 Sol (IQ 60,93, US$ 10). O DeepSeek V4 Flash Vision entra bem abaixo do pódio, mas na faixa em que a maioria das aplicações reais roda — e a um custo que muda a conta no fim do mês.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 557 modelos disponíveis no catálogo nesta data.

O que o preço de US$ 0,66 significa na prática

Traduzindo o marketing: o DeepSeek V4 Flash Vision custa cerca de 38 vezes menos por milhão de tokens de saída que o Claude Opus 5. Em um workload que consome, digamos, 100 milhões de tokens de saída por mês, a diferença entre os dois é de US$ 2.437. Não é ajuste fino — é outra faixa de orçamento. O detalhe técnico que importa: este é o valor de "Reasoning, Max Effort", ou seja, o modo em que o modelo gasta mais raciocínio interno por resposta. Para tarefas que não exigem esse nível de esforço, o custo efetivo cai ainda mais.

A faixa de IQ 45 segue sendo o terreno mais disputada

Olhando o corte de modelos acima de IQ 45 com menor preço de saída, o DeepSeek V4 Flash 0731 (sem o sufixo Vision) lidera a lista a US$ 0,18 por milhão de tokens, com IQ 51,77. O V4 Flash Vision estreia praticamente no mesmo nível de inteligência, mas por 3,7 vezes mais caro. Vale perguntar: você precisa da variante Vision para o seu caso, ou a versão base já resolve? É a pergunta que separa uma conta de API saudável de uma surpresa no fim do mês.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
DeepSeek V4 Flash Vision (Re51.50.66
Qwen3.8 27B (Non-reasoning)34.71.13

Para quem isso muda alguma coisa — e para quem não

Se você roda workloads de visão computacional com raciocínio pesado e vinha pagando entre US$ 5 e US$ 10 por milhão de tokens em modelos equivalentes, o V4 Flash Vision entra como candidato sério a swap. Para quem já usa a versão base do V4 Flash, a novidade é marginal — vale testar, mas não espere salto de qualidade. O Qwen3.8 27B, com IQ 34,74, não compete nessa faixa: fica abaixo do corte de IQ 45 que costuma delimitar modelos "úteis para produção" segundo o próprio Artificial Analysis. Para tarefas simples e baratas, pode servir; para qualquer coisa que exija raciocínio consistente, hoje há opções melhores pelo mesmo preço.

O sinal por trás do barulho

Em 30 dias, 36 modelos entraram no índice. O mercado não está desacelerando — está se estratificando. Enquanto Anthropic e OpenAI disputam o topo absoluto a preços premium, DeepSeek e Qwen ocupam o terreno de quem precisa de inteligência decente sem estourar orçamento. A estreia de hoje é mais um capítulo dessa divisão, e o V4 Flash Vision é o exemplo mais nítido dela: IQ intermediário, preço de commodity.

Em uma frase

Se você roda visão computacional com raciocínio e paga mais de US$ 1 por milhão de tokens, teste o DeepSeek V4 Flash Vision antes do próximo ciclo de cobrança — a economia pode passar de 90% sem perda relevante de qualidade.

Perguntas frequentes

O que é o índice de inteligência do Artificial Analysis?

É a régua que o Artificial Analysis usa para ordenar modelos de linguagem. Varia por snapshot e considera múltiplos benchmarks agregados; quanto maior o IQ, melhor o desempenho médio do modelo nos testes aplicados.

DeepSeek V4 Flash Vision vale a pena em relação ao Claude Opus 5?

Depende do caso. O Opus 5 lidera o índice com IQ 63,05 e custa US$ 25 por milhão de tokens de saída; o V4 Flash Vision entrega IQ 51,47 a US$ 0,66. Para workloads onde a diferença de ~12 pontos de IQ não é crítica, a economia é da ordem de 38 vezes.

Por que o Qwen3.8 27B estreou com IQ tão baixo?

O modelo entrou no modo non-reasoning, que tende a pontuar abaixo de variantes com raciocínio ativado. Mesmo assim, IQ 34,74 o coloca abaixo do corte de IQ 45 que costuma delimitar modelos úteis para produção no próprio índice.

Leia também