Qwen3.7 Max cobra US$ 4,42 por milhão com IQ ainda em branco
Nove dias após o lançamento, o flagship da Alibaba ainda não tem nota oficial de inteligência no catálogo. O que ele tem é um preço no meio do caminho entre DeepSeek e Gemini.
O preço de um flagship sem nota
US$ 4,42 por milhão de tokens de saída. É o que a Qwen3.7 Max custa, nove dias depois do lançamento — e é também o tamanho do problema: o catálogo, que reúne mais de 451 modelos nesta data, ainda não tem nota oficial de inteligência para ela. Você está pagando preço de meio de tabela por um modelo sem benchmark publicado.
Para situar a régua: o DeepSeek V4 Pro cobra US$ 1,74 por milhão de saída com IQ 45,268; o Gemini 3.5 Flash cobra US$ 9 com IQ 46,673; o Gemini 3.1 Pro Preview, US$ 12 com IQ 47,738. A Qwen3.7 Max entra em US$ 4,42 — uma faixa que ainda não tinha dono claro entre custo-benefício agressivo e topo premium.
O que a Alibaba está vendendo
A descrição oficial é direta: flagship da série 3.7, "agent-centric", com força em coding, escritório e produtividade. Traduzindo o marketing: o modelo foi pensado para fluxos em que o agente lê muito, escreve estruturado e chama ferramentas. Não é uma promessa de topo de prateleira em raciocínio puro.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.7-max |
| Criador | qwen |
| Preço de entrada | US$ 1.48 / M tokens |
| Preço de saída | US$ 4.42 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.295 / M (80% de desconto) |
Dois números da ficha sustentam o uso. Um milhão de tokens de contexto é a janela que agentes longos precisam para carregar código, documentação e histórico sem truncar. E US$ 0,295 por milhão lido do cache muda a conta em pipelines que repetem a mesma base de instruções várias vezes na mesma hora — em workflows de agente, esse desconto pesa.
O que o catálogo ainda não mediu
Aqui mora a cautela. IQ, coding, agentic, blended — todos os campos de benchmark estão vazios nesta data. Você está comprando o modelo sem a régua oficial.
Isso não quer dizer que o modelo é ruim. Quer dizer que, se a sua equipe precisa justificar a escolha com dado comparativo — para um CTO, um cliente ou um relatório de procurement —, o argumento "é o flagship da Alibaba" não segura a apresentação sozinho. Os benchmarks públicos ainda não chegaram ou ainda não foram integrados ao catálogo.
Para quem vale — e para quem não muda nada
Vale se você já roda Qwen no stack e quer subir para o topo da família sem trocar de fornecedor. Vale para workloads de agente que exploram a janela de 1M e o cache agressivo, em que cada chamada repetida custa quase um quinto das rivais premium do Google. Vale para times que preferem ficar dentro do ecossistema Alibaba por motivos de latência, compliance ou contrato.
Não muda nada para quem precisa do IQ mais alto da prateleira hoje: o Gemini 3.1 Pro Preview segue na frente em 47,738, e o DeepSeek V4 Pro entrega 45,268 por quase um quarto do preço de saída. Se a decisão é "qual modelo é mais inteligente pelo menor custo", o V4 Pro continua sendo a resposta medida.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
O que fazer com isso agora
Espere a nota de inteligência aparecer antes de migrar workload crítico. Enquanto isso, dá para testar a Qwen3.7 Max em subset pequeno: geração de código em pipelines longos, automação de escritório com prompts estruturados, agentes que se beneficiam da janela ampla. Se o cache cair bem no seu padrão de uso, o custo efetivo pode se aproximar do DeepSeek sem perder o 1M de contexto.
Só vale migrar workload crítico depois que o IQ oficial aparecer; até lá, teste em subset pequeno de agente longo, onde o cache a US$ 0,295/M e os 1M de contexto podem reverter o jogo de custo.
Perguntas frequentes
Qwen3.7 Max é melhor que DeepSeek V4 Pro?
Não dá para responder com os dados de hoje: o IQ da Qwen3.7 Max ainda não foi publicado no catálogo. O DeepSeek V4 Pro está em IQ 45,268 por US$ 1,74/M de saída, ou seja, quase um quarto do preço da Qwen3.7 Max.
Quanto custa a Qwen3.7 Max na API?
US$ 1,475 por milhão de tokens de entrada, US$ 4,425 por milhão de saída e US$ 0,295 por milhão lido do cache. É uma faixa de preço que fica entre o DeepSeek V4 Pro e o Gemini 3.5 Flash.
Para que serve a janela de 1 milhão de tokens da Qwen3.7 Max?
Para carregar código, documentação e histórico de agente em pipelines longos sem truncar. Combinada com o cache barato, ela sustenta fluxos agent-centric do tipo coding e automação de escritório.