FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen 3.5 122B cobra US$ 0,29 e empata com o3 em raciocínio

Modelo chinês aberto chega em fevereiro de 2026 cobrando quase 7 vezes menos por token de entrada do que o veterano da OpenAI.

Redação FalaVIP IA 3 min de leitura
US$ 0,29por milhão de tokens de entrada no Qwen
US$ 8,00por milhão de tokens de saída no o3
32,847índice de inteligência do Qwen 3.5 122B

O chinês que cobra em centavos e o americano que cobra em dólares

A conta de API não perdoa: enquanto o o3 da OpenAI entra na fatura a US$ 2 por milhão de tokens de entrada, o Qwen3.5-122B-A10B cobra US$ 0,29 pelo mesmo volume. São quase sete vezes menos para mandar o mesmo prompt. Na saída, a diferença cai, mas continua doendo: US$ 8 contra US$ 2,40 por milhão de tokens. Em um sistema que processa 10 milhões de tokens de saída por mês, isso é a diferença entre US$ 80 e US$ 24 — e o o3 ainda cobra US$ 0,50 por milhão de tokens no cache, enquanto o Qwen nem publica preço de cache.

Preço de saída (US$ por milhão de tokens)
Qwen3.5-122B-A10B2,4o38US$/M
Fonte: OpenRouter

Inteligência geral: empate técnico, vantagem chinesa por pouco

No índice geral de inteligência medido pela Artificial Analysis, o Qwen3.5-122B-A10B marca 32,847 e o o3 marca 31,096. A diferença existe, mas é de menos de 2 pontos em uma escala que vai muito além dos 50. Para efeitos práticos, os dois estão no mesmo patamar de raciocínio geral. O Qwen ainda entrega 131 tokens por segundo contra 108 do o3, então a vantagem de preço não vem acompanhada de lentidão.

Índice de inteligência (Artificial Analysis)
Qwen3.5-122B-A10B32,8o331,1índice
Fonte: Artificial Analysis

Onde o o3 ainda mostra osso

O o3 traz três coisas que o Qwen não entrega no catálogo. Primeiro, contexto de 200 mil tokens com corte de conhecimento em junho de 2024 declarado; o Qwen oferece 262 mil tokens, mas sem corte publicado. Segundo, o o3 lê arquivos além de imagens; o Qwen lê imagem e vídeo, mas não arquivo. Terceiro, o o3 é fechado e o Qwen é open weights — o que para muita equipe é o ponto decisivo, não o detalhe. Em raciocínio agêntico, o Qwen marca 21,267 e o o3 não tem nota publicada; em coding, o Qwen marca 45,715 e o o3 também não publica. Ou seja: nos benchmarks que o catálogo expôs para o Qwen, o chinês tem dado; nos mesmos benchmarks para o o3, a OpenAI deixou em branco. Vale ler isso com cuidado.

Qwen3.5-122B-A10B × o3
CritérioQwen3.5-122B-A10Bo3
Índice de inteligência32.831.1
Entrada US$/M0.292
Saída US$/M2.48
Contexto262k200k
Pesos abertossimnão
Velocidade (tok/s)131109
Índice de código45.7
Índice agêntico21.3

O tabuleiro em 7 de março de 2026

O catálogo da Artificial Analysis lista 357 modelos de 53 criadores, com 27 lançamentos nos últimos 30 dias. O topo continua dominado por Gemini 3.1 Pro Preview (IQ 47,738) e GPT-5.3-Codex (IQ 45,512), ambos acima de US$ 12 por milhão de tokens de saída. O Qwen3.5-122B-A10B e o o3 brigam uma faixa abaixo, com preços que vão de US$ 2,40 a US$ 8 por milhão de saída. Não é a disputa pelo topo — é a disputa pela fila do meio, onde mora a maioria das aplicações de produção.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 357 modelos disponíveis no catálogo nesta data.

Para quem cada um vale

Qwen3.5-122B-A10B ganha quando o orçamento pesa, quando você precisa de pesos abertos para rodar on-premise ou fazer fine-tuning, e quando velocidade de inferência acima de 130 tokens por segundo faz diferença. É a escolha para times que processam volume e podem hospedar o modelo.

o3 ganha quando o pipeline já está na OpenAI, quando você precisa ler PDFs e arquivos misturados no mesmo request, e quando a equipe prefere não operar infraestrutura de modelo. É a escolha para produtos que já rodam em Assistants API e não querem migrar.

Em resumo: o chinês entrega 95% do raciocínio por 12% do preço na entrada; o americano entrega maturidade de ecossistema por quase 3x o preço na saída. Para um CTO de empresa pequena olhando a fatura de março, a pergunta não é "qual é melhor" — é "quanto estou pagando a mais pela conveniência".

Em uma frase

Se o orçamento manda, migre cargas de raciocínio geral para o Qwen 3.5 122B; se a conveniência do ecossistema OpenAI pesa mais que a diferença de US$ 5,60 por milhão de tokens de saída, fique no o3.

Perguntas frequentes

Qwen 3.5 122B é realmente mais barato que o o3?

Sim. Custa US$ 0,29 por milhão de tokens de entrada contra US$ 2,00 do o3, e US$ 2,40 por milhão de tokens de saída contra US$ 8,00. Em volumes grandes, a economia na entrada é quase sete vezes.

O Qwen 3.5 122B tem código aberto?

Sim. O modelo é listado como open_weights no catálogo, com 125 bilhões de parâmetros totais e 10 bilhões ativos. Isso permite hospedar e fazer fine-tuning, ao contrário do o3, que é fechado.

Qual dos dois tem contexto maior?

O Qwen 3.5 122B oferece 262.144 tokens de contexto contra 200.000 do o3. Porém, o o3 declara corte de conhecimento em junho de 2024, enquanto o Qwen não publica essa data no catálogo.

Leia também