FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Qwen 3.8 27B chega a US$ 2,55 e aperta a conta da API

O modelo aberto custa menos que versões maiores da própria Qwen e estreia com notas fortes em código e agentes. Mas o catálogo também registra reajustes de até 88,9% em concorrentes.

Redação FalaVIP IA 4 min de leitura
US$ 0,425por milhão de tokens de entrada
US$ 2,55por milhão de tokens de saída
1 milhãode tokens na janela de contexto

O Qwen 3.8 27B estreia custando US$ 0,425 por milhão de tokens de entrada e US$ 2,55 por milhão de tokens de saída, com contexto de 1 milhão de tokens. Para quem paga a fatura da API, esse é o número que importa: o modelo coloca uma janela longa e notas altas em programação dentro de uma faixa de preço abaixo das versões maiores da própria Qwen.

Os preços são os listados no OpenRouter. As notas de código e uso agêntico vêm do Artificial Analysis. O modelo tem 27 bilhões de parâmetros, pesos abertos e foi lançado em 14 de agosto de 2026.

A notícia, portanto, não é que todo trabalho de desenvolvimento ficou mais barato. É que uma opção aberta chega com uma combinação rara de custo, contexto e desempenho — justamente quando outros modelos ficaram mais caros.

Código forte, mas sem ultrapassar o Qwen Max

O Artificial Analysis atribui ao Qwen 3.8 27B nota 68,075 em coding e 50,877 em agentic. É uma estreia relevante para um modelo desse porte, especialmente para tarefas que exigem escrever, revisar e alterar código ou coordenar etapas de uma execução.

Mas a comparação precisa ser feita com cuidado. O Qwen 3.8 Max, que também aparece no catálogo, marca 71,813 em coding e 58,403 em agentic. Ele custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. A versão de 27B é mais barata, mas não supera o modelo Max nos dois índices disponíveis.

A afirmação de que o novo modelo superou o Claude Opus 4.7 não pode ser confirmada pelos dados publicados: o catálogo traz preço e contexto para o Opus 4.7, mas não traz notas comparáveis de coding ou agentic. O Claude Opus 4.7 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, com o mesmo contexto de 1 milhão de tokens.

A pauta foi originada pelo vídeo “Qwen 3.8 27B superou o Opus 4.7 e roda LOCAL”, do canal Vini — AI Coders Academy. O ponto verificável sobre execução local é que o Qwen 3.8 27B tem pesos abertos. Isso não informa, por si só, a velocidade ou o hardware necessário para uma implantação.

O contexto longo é parte da conta

Uma janela de 1 milhão de tokens pode ser mais importante que a diferença de preço em aplicações que enviam repositórios, históricos extensos, documentos ou várias etapas de um agente. Você pode reduzir a necessidade de resumir o contexto antes de cada chamada, mas isso não elimina o custo: tokens enviados continuam entrando na cobrança.

O Qwen 3.5 27B, outra opção de 27B no catálogo, custa US$ 0,195 por milhão de tokens de entrada e US$ 1,56 por milhão de tokens de saída, mas tem contexto de 262.144 tokens. Já o Qwen 3.6 27B custa US$ 0,60 na entrada e US$ 3,60 na saída, também com contexto de 262.144 tokens.

Para uma aplicação que raramente passa de uma janela curta, o lançamento não é automaticamente a opção mais econômica. O ganho aparece quando o contexto longo evita múltiplas chamadas, truncamentos ou uma arquitetura adicional de recuperação.

O mercado ficou menos previsível no mesmo dia

O lançamento acontece em um catálogo que registrou 12 mudanças de preço em 14 de agosto. O GLM 5.2 passou de US$ 1,98 para US$ 3,74 por milhão de tokens, uma alta de 88,9%. O Kimi K2.6 foi de US$ 2,36 para US$ 4, avanço de 69,5%. O DeepSeek V4 Flash 0731 subiu de US$ 0,18 para US$ 0,28, alta de 55,6%.

Houve movimentos no sentido contrário. O DeepSeek V4 Flash Latest caiu de US$ 0,252 para US$ 0,16, enquanto o Qwen3 VL 30B A3B Instruct recuou de US$ 0,60 para US$ 0,52. A própria lista registra mais de uma alteração para alguns modelos, como Kimi K2.6, GLM 5.2 e Llama 4 Maverick. Antes de trocar um modelo em produção, você precisa conferir a variante exata e o preço vigente.

Para quem vale a troca

O Qwen 3.8 27B faz sentido para quem precisa de código, agentes e contexto longo sem depender de um modelo fechado caro — especialmente se a empresa também considera hospedar pesos abertos. Ele é candidato a testes em revisão de pull requests, geração de código, automações internas e fluxos com muitos documentos.

Para quem exige a maior nota disponível de inteligência geral, a estreia não muda o topo: o Claude Opus 5 com raciocínio adaptativo e esforço máximo aparece com 63,1 de IQ e custa US$ 10 por milhão de tokens. O novo Qwen não tem nota de IQ registrada no Artificial Analysis.

Também não muda nada para uma operação que já usa um modelo mais barato e curto, sem problemas de contexto ou de qualidade em código. Nesse caso, o preço de entrada do Qwen3.5 27B pode continuar sendo menor, e a migração só se justifica após testar qualidade, latência e custo total.

A implicação prática é direta: coloque o Qwen 3.8 27B no benchmark da sua aplicação, mas compare o custo por tarefa — não apenas o preço por token — antes de substituir o modelo atual.

Em uma frase

O Qwen 3.8 27B é uma opção aberta forte para código e contexto longo, mas a economia só aparece se esses recursos reduzirem chamadas ou permitirem trocar modelos mais caros.

Perguntas frequentes

Quanto custa o Qwen 3.8 27B na API?

No OpenRouter, ele custa US$ 0,425 por milhão de tokens de entrada e US$ 2,55 por milhão de tokens de saída. A janela de contexto é de 1 milhão de tokens.

O Qwen 3.8 27B supera o Claude Opus 4.7?

Os dados disponíveis não confirmam essa comparação. O Artificial Analysis registra coding de 68,075 e agentic de 50,877 para o Qwen, mas não traz essas notas para o Claude Opus 4.7.

O Qwen 3.8 27B pode rodar localmente?

O catálogo marca o modelo como de pesos abertos, o que permite considerar uma implantação local. Os dados não informam, porém, o hardware necessário nem a velocidade de execução.

Fontes

Leia também