Qwen3 Coder Next custa 47% menos que o Mistral Large 3 2512 e entrega mais código
Dois modelos abertos lançados em dois meses brigam pelo mesmo nicho de agente de programação, com preços e desempenhos bem diferentes na régua de hoje.
O que está em jogo
Você olha o catálogo hoje e encontra 330 modelos listados, 52 criadores, 16 lançamentos nos últimos 30 dias. Dois deles disputam o mesmo canto da prateleira: programação agêntica, pesos abertos, contexto de 262 mil tokens. Um é chinês e chegou há quatro dias. O outro é francês e está no mercado desde dezembro. A diferença entre eles não está só no preço — está em qual trabalho cada um aguenta sem você fechar a aba de frustração.
A conta que ninguém gosta de fazer
O Qwen3 Coder Next cobra US$ 0,12 por milhão de tokens de entrada e US$ 0,80 por milhão de tokens de saída. O Mistral Large 3 2512 cobra US$ 0,50 na entrada e US$ 1,50 na saída. Em um mês em que você gasta, digamos, 100 milhões de tokens de saída, a diferença é de US$ 70 — R$ 400 a mais no cartão só para usar o francês.
Mas preço sem qualidade é só barateza. O índice de inteligência do catálogo nesta data mostra onde cada um se encaixa:
O Qwen3 Coder Next marca 21,29 pontos de IQ geral e 36,23 em coding. O Mistral Large 3 2512 marca 15,92 de IQ geral e 20,07 em coding. Em outras palavras: o chinês custa quase a metade e pontua mais alto nas duas réguas. O cache hit do Mistral é mais barato (US$ 0,05 contra US$ 0,07), o que ajuda quem repete muito o mesmo prompt — mas isso é ajuste fino, não virada de jogo.
Onde cada um vence de verdade
| Critério | Qwen3 Coder Next | Mistral Large 3 2512 |
|---|---|---|
| Índice de inteligência | 21.3 | 15.9 |
| Entrada US$/M | 0.12 | 0.5 |
| Saída US$/M | 0.8 | 1.5 |
| Contexto | 262k | 262k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 130 | 77 |
| Índice de código | 36.2 | 20.1 |
| Índice agêntico | 8.9 | 5.5 |
O Qwen3 Coder Next é um sparse MoE com 79,7 bilhões de parâmetros totais e só 3 bilhões ativos por passagem. Esse desenho explica a velocidade: 129,5 tokens por segundo, contra 77,45 do Mistral. Para um agente de programação que fica em loop chamando ferramentas, ler e escrever rápido muda a experiência do desenvolvedor mais do que parece. É a diferença entre esperar três segundos e esperar oito.
O Mistral Large 3 2512 é outra filosofia: 675 bilhões totais, 41 bilhões ativos, multimodal (aceita texto, imagem e arquivo). Se você precisa jogar um PDF ou uma screenshot no meio do fluxo, o francês é o único dos dois que topa. O custo disso é o dobro do preço de saída e a metade da velocidade.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Coder Next | 21.3 | 0.8 |
Nenhum dos dois é modelo de raciocínio — ambos respondem direto, sem cadeia de pensamento visível. Quem precisa planejar antes de codar vai ter que somar outro modelo ao stack.
Para quem cada um vale
Qwen3 Coder Next vale para você que roda agente de código em loop, quer resposta rápida, não precisa mandar imagem, e olha a fatura no fim do mês. É o caso de uso mais comum em times pequenos que colocam LLM no CI, em IDE ou em bot de revisão.
Mistral Large 3 2512 vale para você que precisa de multimodalidade real — análise de print de erro, leitura de PDF de especificação, OCR de slide — e tem orçamento para pagar US$ 1,50 por milhão de tokens de saída sem fazer careta.
Nenhum dos dois vale para quem busca o topo absoluto de inteligência geral. O ranking de hoje tem Xiaomi MiMo-V2-Flash em 34,02, OpenAI o3 em 31,10 e Claude Haiku 4.5 em 29,89 — todos acima dos dois comparados aqui. Para raciocínio pesado, a conta vai para outro lugar.
O que muda na sua pilha
Se você está montando um agente de código hoje e o gargalo é custo, o Qwen3 Coder Next é a escolha óbvia: mais barato, mais rápido e melhor em coding. Se multimodalidade é requisito não negociável, o Mistral Large 3 2512 entra — mas prepare o orçamento. O resto é cenário.
Para coding agent puro, troque o Mistral Large 3 2512 pelo Qwen3 Coder Next e corte quase metade da fatura mantendo (ou melhorando) a qualidade; só mantenha o Mistral se você depende de entrada de imagem ou PDF.
Perguntas frequentes
Qual é mais barato, Qwen3 Coder Next ou Mistral Large 3 2512?
O Qwen3 Coder Next custa US$ 0,80 por milhão de tokens de saída, contra US$ 1,50 do Mistral Large 3 2512 — uma diferença de 47% no preço de saída, com entrada também mais barata (US$ 0,12 contra US$ 0,50).
Qual dos dois é melhor para coding agent?
O Qwen3 Coder Next marca 36,23 em coding contra 20,07 do Mistral, e roda a 129,5 tokens por segundo contra 77,45. Para agente de programação puro, ele entrega mais por menos.
O Mistral Large 3 2512 aceita imagem?
Sim. A modalidade é texto+imagem+arquivo para texto, enquanto o Qwen3 Coder Next só aceita texto. Se você precisa jogar print de erro ou PDF no fluxo, o Mistral é o único dos dois que resolve.