FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Cinco modelos estreiam no índice com IQ entre 11 e 46 — e só dois custam menos de US$ 1

Do topo da régua ao fundo do poço: Kimi K3 low e dois DeepSeek V4 Flash puxam a fila dos baratos, enquanto Celeris-1 entra com nota de um dígito.

Redação FalaVIP IA 4 min de leitura
US$ 0,175por milhão de tokens de saída do DeepSeek V4 Flash (Reasoning, Max Effort)
46,603IQ do Kimi K3 (low), o mais inteligente das cinco estreias
11,81IQ do Celeris-1, a estreia mais fraca do dia

O índice ganhou cinco nomes hoje — e a régua ficou ainda mais torta

Cinco modelos entraram no índice do Artificial Analysis nesta sexta-feira. Juntos, eles cobrem uma faixa que vai de IQ 11,8 a 46,6 — quase 35 pontos de diferença entre o melhor e o pior do mesmo dia. Não é uma estreia qualquer: é um retrato do mercado em 2026, onde o topo custa caro, o meio tem nome chinês, e o fundo do poço ainda recebe lançamentos.

Índice de inteligência das estreias
Kimi K3 (low)46,6DeepSeek V4 Flash (Reasoning40,3Inkling Small40,2DeepSeek V4 Flash (Reasoning37,5Celeris-111,8índice

Kimi K3 (low) lidera as estreias — mas é 12 pontos mais burro que o irmão maior

O destaque do dia é o Kimi K3 (low), da MoonshotAI, com IQ 46,6 e preço de US$ 6 por milhão de tokens de saída. Parece razoável até você comparar com o que a própria MoonshotAI já tem no topo do índice: o Kimi K3 "cheio" marca IQ 59,7 a US$ 15 por milhão. Ou seja, a variante "low" entrega 78% da inteligência por 40% do preço.

É o tipo de corte que faz sentido para quem roda o modelo em volume e topa perder precisão em troca de fôlego no orçamento. Não faz sentido para quem usa o K3 em tarefas onde cada ponto de raciocínio conta.

DeepSeek V4 Flash aparece duas vezes — e em ambas é o mais barato do índice

A DeepSeek emplacou duas variantes do V4 Flash com raciocínio no dia: uma em Max Effort (IQ 40,3) e outra em High Effort (IQ 37,5). As duas custam US$ 0,175 por milhão de tokens de saída.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Kimi K3 (low)46.66.00
DeepSeek V4 Flash (Reasoning40.30.17
Inkling Small40.20.53
DeepSeek V4 Flash (Reasoning37.50.17
Celeris-111.83.00

Esse preço não é novidade absoluta — o V4 Flash já aparecia em US$ 0,18 na lista de "mais baratos acima de IQ 45" do próprio índice. O que muda hoje é a entrada formal da versão com raciocínio ativado, que historicamente custa mais caro que a versão padrão. A DeepSeek está cobrando o mesmo preço pelas duas. Para quem precisa de chain-of-thought sem estourar a fatura, é a oferta mais agressiva do catálogo.

Inkling Small entra no meio-termo — e ninguém sabe de onde veio

O Inkling Small apareceu com IQ 40,2 e preço de US$ 0,525 por milhão de tokens. É um valor três vezes maior que o DeepSeek V4 Flash com raciocínio, mas com inteligência praticamente igual. O catálogo não traz mais informações sobre o criador — o nome não bate com nenhum laboratório conhecido do índice.

Se você está avaliando esse modelo, a pergunta certa não é "quanto custa" e sim "quem está por trás e em quais tarefas ele foi testado". Sem isso, é difícil recomendar contra um DeepSeek mais barato e com nota equivalente.

Celeris-1: a estreia com nota de um dígito

No outro extremo está o Celeris-1, com IQ 11,8 e preço de US$ 3 por milhão de tokens. É a estreia mais fraca do índice — e uma das mais fracas já registradas. Para efeito de comparação, o Claude Opus 5, no topo da régua, marca IQ 63,1 a US$ 25 por milhão.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 527 modelos disponíveis no catálogo nesta data.

Pagar US$ 3 por milhão num modelo que entrega um quinto da inteligência do líder de mercado é, em quase qualquer cenário, pior do que pagar US$ 25 pelo Opus 5. A única exceção possível seria uma tarefa absurdamente simples e em volume absurdo — e mesmo assim, o DeepSeek V4 Flash Max Effort, a US$ 0,175, entrega três vezes mais IQ pelo mesmo custo.

O que isso muda na sua escolha

O dia de hoje reforça um padrão que já vinha se desenhando: o chão do índice está cada vez mais barato, mas o teto continua caro. As duas estreias da DeepSeek mostram que dá para ter raciocínio ativado por menos de US$ 0,20 por milhão. O Kimi K3 low mostra que dá para ter 78% da inteligência de um modelo top por 40% do preço.

Na prática, se você roda agentes ou pipelines em volume, o V4 Flash com raciocínio virou o novo padrão de custo-benefício. Se você precisa de qualidade máxima e o orçamento permite, o topo segue sendo Anthropic e OpenAI. E o Celeris-1? Pode ignorar — a menos que alguém explique para que serve um IQ de 11,8 a US$ 3 por milhão.

Para quem vale e para quem não vale

  • Vale para: times que rodam modelos em volume e podem trocar 20% de qualidade por 90% de economia; quem está montando pipelines de agentes onde o custo por chamada importa mais que a nota no benchmark.
  • Não muda nada para: quem usa modelos top para tarefas onde cada ponto de IQ se traduz em receita (geração de código crítica, análise jurídica, pesquisa longa). O Celeris-1 e o Inkling Small não entram nessa conta.

O catálogo do Artificial Analysis fechou o dia com mais de 527 modelos listados, 66 criadores diferentes e 47 lançamentos nos últimos 30 dias. A fila de estreias não para — e a régua continua ficando mais longa nas duas pontas.

Em uma frase

Se você roda modelo em volume, o DeepSeek V4 Flash com raciocínio (US$ 0,175/M) virou o novo padrão de custo-benefício; se precisa de teto de qualidade, o topo segue sendo Anthropic e OpenAI, e as estreias de hoje não mudam isso.

Perguntas frequentes

Qual modelo estreou com o melhor IQ hoje no Artificial Analysis?

O Kimi K3 (low), da MoonshotAI, com IQ 46,603 e preço de US$ 6 por milhão de tokens de saída. Ainda assim, fica 12 pontos atrás do Kimi K3 "full", que marca IQ 59,7.

Quanto custa o DeepSeek V4 Flash com raciocínio ativado?

US$ 0,175 por milhão de tokens de saída, tanto na variante Max Effort (IQ 40,3) quanto na High Effort (IQ 37,5). É o preço mais baixo do índice entre modelos com raciocínio.

O Celeris-1 vale a pena pelo preço?

Não, pelo menos não em quase nenhum cenário. Com IQ 11,8 a US$ 3 por milhão, entrega um quinto da inteligência do Claude Opus 5 pelo mesmo preço que o DeepSeek V4 Flash Max Effort entrega três vezes mais IQ.