FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3.7 Max cobra US$ 4,42 por milhão com IQ ainda em branco

Nove dias após o lançamento, o flagship da Alibaba ainda não tem nota oficial de inteligência no catálogo. O que ele tem é um preço no meio do caminho entre DeepSeek e Gemini.

Redação FalaVIP IA 2 min de leitura
US$ 4,425por milhão de tokens de saída
US$ 0,295por milhão de tokens lidos do cache
1.000.000tokens de contexto

O preço de um flagship sem nota

US$ 4,42 por milhão de tokens de saída. É o que a Qwen3.7 Max custa, nove dias depois do lançamento — e é também o tamanho do problema: o catálogo, que reúne mais de 451 modelos nesta data, ainda não tem nota oficial de inteligência para ela. Você está pagando preço de meio de tabela por um modelo sem benchmark publicado.

Para situar a régua: o DeepSeek V4 Pro cobra US$ 1,74 por milhão de saída com IQ 45,268; o Gemini 3.5 Flash cobra US$ 9 com IQ 46,673; o Gemini 3.1 Pro Preview, US$ 12 com IQ 47,738. A Qwen3.7 Max entra em US$ 4,42 — uma faixa que ainda não tinha dono claro entre custo-benefício agressivo e topo premium.

O que a Alibaba está vendendo

A descrição oficial é direta: flagship da série 3.7, "agent-centric", com força em coding, escritório e produtividade. Traduzindo o marketing: o modelo foi pensado para fluxos em que o agente lê muito, escreve estruturado e chama ferramentas. Não é uma promessa de topo de prateleira em raciocínio puro.

Ficha técnica — Qwen3.7 Max
CampoValor
Identificadorqwen/qwen3.7-max
Criadorqwen
Preço de entradaUS$ 1.48 / M tokens
Preço de saídaUS$ 4.42 / M tokens
Janela de contexto1M
Modalidadetext->text
Leitura de cacheUS$ 0.295 / M (80% de desconto)

Dois números da ficha sustentam o uso. Um milhão de tokens de contexto é a janela que agentes longos precisam para carregar código, documentação e histórico sem truncar. E US$ 0,295 por milhão lido do cache muda a conta em pipelines que repetem a mesma base de instruções várias vezes na mesma hora — em workflows de agente, esse desconto pesa.

O que o catálogo ainda não mediu

Aqui mora a cautela. IQ, coding, agentic, blended — todos os campos de benchmark estão vazios nesta data. Você está comprando o modelo sem a régua oficial.

Isso não quer dizer que o modelo é ruim. Quer dizer que, se a sua equipe precisa justificar a escolha com dado comparativo — para um CTO, um cliente ou um relatório de procurement —, o argumento "é o flagship da Alibaba" não segura a apresentação sozinho. Os benchmarks públicos ainda não chegaram ou ainda não foram integrados ao catálogo.

Para quem vale — e para quem não muda nada

Vale se você já roda Qwen no stack e quer subir para o topo da família sem trocar de fornecedor. Vale para workloads de agente que exploram a janela de 1M e o cache agressivo, em que cada chamada repetida custa quase um quinto das rivais premium do Google. Vale para times que preferem ficar dentro do ecossistema Alibaba por motivos de latência, compliance ou contrato.

Não muda nada para quem precisa do IQ mais alto da prateleira hoje: o Gemini 3.1 Pro Preview segue na frente em 47,738, e o DeepSeek V4 Pro entrega 45,268 por quase um quarto do preço de saída. Se a decisão é "qual modelo é mais inteligente pelo menor custo", o V4 Pro continua sendo a resposta medida.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
Entre os 451 modelos disponíveis no catálogo nesta data.

O que fazer com isso agora

Espere a nota de inteligência aparecer antes de migrar workload crítico. Enquanto isso, dá para testar a Qwen3.7 Max em subset pequeno: geração de código em pipelines longos, automação de escritório com prompts estruturados, agentes que se beneficiam da janela ampla. Se o cache cair bem no seu padrão de uso, o custo efetivo pode se aproximar do DeepSeek sem perder o 1M de contexto.

Em uma frase

Só vale migrar workload crítico depois que o IQ oficial aparecer; até lá, teste em subset pequeno de agente longo, onde o cache a US$ 0,295/M e os 1M de contexto podem reverter o jogo de custo.

Perguntas frequentes

Qwen3.7 Max é melhor que DeepSeek V4 Pro?

Não dá para responder com os dados de hoje: o IQ da Qwen3.7 Max ainda não foi publicado no catálogo. O DeepSeek V4 Pro está em IQ 45,268 por US$ 1,74/M de saída, ou seja, quase um quarto do preço da Qwen3.7 Max.

Quanto custa a Qwen3.7 Max na API?

US$ 1,475 por milhão de tokens de entrada, US$ 4,425 por milhão de saída e US$ 0,295 por milhão lido do cache. É uma faixa de preço que fica entre o DeepSeek V4 Pro e o Gemini 3.5 Flash.

Para que serve a janela de 1 milhão de tokens da Qwen3.7 Max?

Para carregar código, documentação e histórico de agente em pipelines longos sem truncar. Combinada com o cache barato, ela sustenta fluxos agent-centric do tipo coding e automação de escritório.

Leia também