FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Coder Next: 27% mais barato e IQ 35% maior que o INTELLECT-3

Comparativo entre dois modelos MoE open-weight revela onde cada um entrega mais pelo token gasto e por que o americano ainda vale os 27% extras em tarefas que pedem raciocínio.

Redação FalaVIP IA 3 min de leitura
US$ 0,80 vs US$ 1,10preço de saída por milhão de tokens
21,3 vs 15,7índice de inteligência (Artificial Analysis)
36,2nota de coding do Qwen3 Coder Next

Dois modelos abertos, dois discursos parecidos — "estado da arte para o tamanho" — e contas que não combinam. O Qwen3 Coder Next entrou no catálogo em 4 de fevereiro, seis dias atrás, cobrando US$ 0,80 por milhão de tokens de saída. O INTELLECT-3, da Prime Intellect, está no ar desde 27 de novembro de 2025 e sai por US$ 1,10. Em um comparativo frente a frente, essa diferença de 27% no output não é o único argumento a favor do chinês.

Preço de saída (US$ por milhão de tokens)
Qwen3 Coder Next0,8INTELLECT-31,1US$/M
Fonte: OpenRouter

O que cada um diz ser

O Qwen3 Coder Next se vende como "modelo causal de pesos abertos otimizado para agentes de código e fluxos de desenvolvimento local". É uma descrição direta: sparse MoE com cerca de 80B de parâmetros totais e só 3B ativados por token, pensado para rodar em hardware mais barato. Não tem modo de raciocínio.

O INTELLECT-3 vem dos Estados Unidos, também open-weight, também MoE: 107B totais, 12B ativos. Foi pós-treinado em cima do GLM-4.5-Air-Base — base chinesa, fine-tuning americano — via SFT seguido de RL em larga escala. E, ao contrário do Qwen, tem raciocínio ativado por padrão: você paga tokens extras para ele pensar antes de responder.

Preço: onde a fatura dói mais

A diferença no input é menor: US$ 0,12 contra US$ 0,20 por milhão de tokens. No output, que é o que normalmente infla a conta de agente de código, a diferença cresce: US$ 0,80 contra US$ 1,10. Se o seu agente cospe diffs grandes, explicações longas ou suites de teste inteiras, esses 27% se acumulam rápido — e a fatura no fim do mês não perdoa.

Qwen3 Coder Next × INTELLECT-3
CritérioQwen3 Coder NextINTELLECT-3
Índice de inteligência21.315.7
Entrada US$/M0.120.2
Saída US$/M0.81.1
Contexto262k131k
Pesos abertossimsim
Velocidade (tok/s)130
Índice de código36.2
Índice agêntico8.9

O Qwen também publica tarifa de cache: US$ 0,07 por milhão de tokens. O INTELLECT-3 não publicou preço de cache no catálogo. Se você depende de prompt cacheado para amortizar, esse campo vazio é uma informação que falta antes de fechar a decisão.

Inteligência e código: o medidor não mente

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 331 modelos disponíveis no catálogo nesta data.

O catálogo de hoje, 10 de fevereiro, tem mais de 331 modelos listados. No topo do índice de inteligência aparece o Xiaomi MiMo-V2-Flash, com 34, seguido pelo OpenAI o3 (31) e pelo Claude Haiku 4.5 (29,9). O Qwen3 Coder Next, com IQ de 21,3, e o INTELLECT-3, com 15,7, ocupam faixas intermediárias — nenhum dos dois está brigando pela ponta, mas estão distantes entre si.

Índice de inteligência (Artificial Analysis)
Qwen3 Coder Next21,3INTELLECT-315,7índice
Fonte: Artificial Analysis

Em coding, o Qwen pontua 36,2 — único dos dois com nota publicada nessa categoria. Em agentic, 8,9 contra dado ausente para o INTELLECT-3. Em velocidade medida, 129,5 tokens por segundo contra nada publicado para o americano. Nas métricas que os dois compartilham, o Qwen está à frente com folga.

Onde o INTELLECT-3 ainda vence

A primeira vantagem é raciocínio ativado por padrão. O Qwen3 Coder Next não tem modo reasoning. Se a tarefa exige cadeia de raciocínio explícita — matemática multi-step, decisão de arquitetura, planejamento de agente de longo horizonte — o INTELLECT-3 é a única opção dos dois, e vale pagar o extra.

A segunda é o índice de onisciência: -50,85 contra -62,4 do Qwen. Esse número mede o quanto o modelo erra quando erra — quanto mais perto de zero, menos alucinação confiante. Em domínios onde admitir "não sei" é melhor do que inventar — triagem preliminar, due diligence, código que toca produção sem revisão humana — o INTELLECT-3 erra de forma menos custosa.

A terceira é músculo por token: 12B ativos é o dobro dos 3B ativos do Qwen. Em GPU única potente, o INTELLECT-3 entrega mais parâmetro processado por passada; em hardware enxuto, o Qwen sobra.

Quando usar cada um

Use o Qwen3 Coder Next quando o trabalho for gerar código, ler código ou operar como agente de desenvolvimento com janela de 262 mil tokens. Você ganha no preço, no IQ, na nota específica de coding e na velocidade publicada. É o modelo de fevereiro de 2026 para essa função.

Use o INTELLECT-3 quando a tarefa exigir raciocínio encadeado, quando a precisão factual pesar mais que o custo por token, ou quando você precisar que o modelo erre pequeno em vez de errar grande. Pague os 27% extras de output e leve o raciocínio ligado para casa.

Em uma frase

Para gerar e ler código com janela longa, vá de Qwen3 Coder Next e economize 27% no output; quando o trabalho pedir raciocínio explícito ou menos alucinação confiante, pague o extra e fique com INTELLECT-3.

Perguntas frequentes

Qual é mais barato, Qwen3 Coder Next ou INTELLECT-3?

O Qwen3 Coder Next custa US$ 0,12 de input e US$ 0,80 de output por milhão de tokens; o INTELLECT-3 sai por US$ 0,20 e US$ 1,10. No output, a economia do Qwen chega a 27%.

Os dois modelos são open-weight?

Sim. O Qwen3 Coder Next tem 79,7B de parâmetros totais com 3B ativos e o INTELLECT-3 tem 107B totais com 12B ativos. Ambos são MoE com pesos abertos, mas o INTELLECT-3 é bem mais exigente em VRAM.

Qual escolher para um agente de código em produção?

Se o agente gera muito código, prefira o Qwen3 Coder Next pelo preço, IQ mais alto (21,3 contra 15,7) e nota de coding de 36,2. Se a tarefa exige raciocínio explícito ou baixa alucinação, o INTELLECT-3 justifica o custo extra.

Leia também