DeepSeek V4 Flash Vision estreia a US$ 0,66 e empurra o índice de inteligência
Qwen3.8 27B entra junto, mas fica longe do pelotão intermediário. Enquanto isso, Claude Opus 5 segue no topo a US$ 25 por milhão de tokens.
Dois modelos chineses, dois pontos muito diferentes da régua
Dois modelos chineses entraram hoje no índice do Artificial Analysis, e a distância entre eles é o que chama atenção. O DeepSeek V4 Flash Vision (Reasoning, Max Effort) cravou IQ 51,47 e custa US$ 0,66 por milhão de tokens de saída. O Qwen3.8 27B (Non-reasoning) ficou em IQ 34,74 e sai por US$ 1,125. Mesmo pagando quase o dobro, o Qwen entrega menos inteligência por dólar. É o tipo de estreia que faz você repensar a tentação de escolher só pelo nome do criador.
Onde eles caem no tabuleiro
O catálogo do Artificial Analysis soma hoje 557 modelos ativos vindos de 70 criadores — e esse número é um piso, porque modelos removidos depois somem da lista. Para situar as estreias, vale olhar quem está no topo agora: Claude Opus 5 lidera com IQ 63,05 a US$ 25 por milhão de tokens de saída, seguido de Claude Fable 5 (IQ 62,07, US$ 50) e GPT-5.6 Sol (IQ 60,93, US$ 10). O DeepSeek V4 Flash Vision entra bem abaixo do pódio, mas na faixa em que a maioria das aplicações reais roda — e a um custo que muda a conta no fim do mês.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
O que o preço de US$ 0,66 significa na prática
Traduzindo o marketing: o DeepSeek V4 Flash Vision custa cerca de 38 vezes menos por milhão de tokens de saída que o Claude Opus 5. Em um workload que consome, digamos, 100 milhões de tokens de saída por mês, a diferença entre os dois é de US$ 2.437. Não é ajuste fino — é outra faixa de orçamento. O detalhe técnico que importa: este é o valor de "Reasoning, Max Effort", ou seja, o modo em que o modelo gasta mais raciocínio interno por resposta. Para tarefas que não exigem esse nível de esforço, o custo efetivo cai ainda mais.
A faixa de IQ 45 segue sendo o terreno mais disputada
Olhando o corte de modelos acima de IQ 45 com menor preço de saída, o DeepSeek V4 Flash 0731 (sem o sufixo Vision) lidera a lista a US$ 0,18 por milhão de tokens, com IQ 51,77. O V4 Flash Vision estreia praticamente no mesmo nível de inteligência, mas por 3,7 vezes mais caro. Vale perguntar: você precisa da variante Vision para o seu caso, ou a versão base já resolve? É a pergunta que separa uma conta de API saudável de uma surpresa no fim do mês.
| Modelo | Índice de inteligência | Preço combinado US$/M |
|---|---|---|
| DeepSeek V4 Flash Vision (Re | 51.5 | 0.66 |
| Qwen3.8 27B (Non-reasoning) | 34.7 | 1.13 |
Para quem isso muda alguma coisa — e para quem não
Se você roda workloads de visão computacional com raciocínio pesado e vinha pagando entre US$ 5 e US$ 10 por milhão de tokens em modelos equivalentes, o V4 Flash Vision entra como candidato sério a swap. Para quem já usa a versão base do V4 Flash, a novidade é marginal — vale testar, mas não espere salto de qualidade. O Qwen3.8 27B, com IQ 34,74, não compete nessa faixa: fica abaixo do corte de IQ 45 que costuma delimitar modelos "úteis para produção" segundo o próprio Artificial Analysis. Para tarefas simples e baratas, pode servir; para qualquer coisa que exija raciocínio consistente, hoje há opções melhores pelo mesmo preço.
O sinal por trás do barulho
Em 30 dias, 36 modelos entraram no índice. O mercado não está desacelerando — está se estratificando. Enquanto Anthropic e OpenAI disputam o topo absoluto a preços premium, DeepSeek e Qwen ocupam o terreno de quem precisa de inteligência decente sem estourar orçamento. A estreia de hoje é mais um capítulo dessa divisão, e o V4 Flash Vision é o exemplo mais nítido dela: IQ intermediário, preço de commodity.
Se você roda visão computacional com raciocínio e paga mais de US$ 1 por milhão de tokens, teste o DeepSeek V4 Flash Vision antes do próximo ciclo de cobrança — a economia pode passar de 90% sem perda relevante de qualidade.
Perguntas frequentes
O que é o índice de inteligência do Artificial Analysis?
É a régua que o Artificial Analysis usa para ordenar modelos de linguagem. Varia por snapshot e considera múltiplos benchmarks agregados; quanto maior o IQ, melhor o desempenho médio do modelo nos testes aplicados.
DeepSeek V4 Flash Vision vale a pena em relação ao Claude Opus 5?
Depende do caso. O Opus 5 lidera o índice com IQ 63,05 e custa US$ 25 por milhão de tokens de saída; o V4 Flash Vision entrega IQ 51,47 a US$ 0,66. Para workloads onde a diferença de ~12 pontos de IQ não é crítica, a economia é da ordem de 38 vezes.
Por que o Qwen3.8 27B estreou com IQ tão baixo?
O modelo entrou no modo non-reasoning, que tende a pontuar abaixo de variantes com raciocínio ativado. Mesmo assim, IQ 34,74 o coloca abaixo do corte de IQ 45 que costuma delimitar modelos úteis para produção no próprio índice.