GPT-5.3-Codex a US$ 14 ou MiMo-V2.5 a US$ 0,28 por milhão de tokens?
O Codex lidera em inteligência e velocidade. O MiMo responde com 50x mais barato, contexto 2,6x maior e pesos abertos. Cada um ganha num cenário — e a conta decide.
A conta que o release não mostra
A OpenAI apresenta o GPT-5.3-Codex como o "modelo de codificação agêntica mais avançado" da casa. O que o release não coloca em destaque é o preço de saída: US$ 14 por milhão de tokens. A 118 tokens por segundo, é a referência para quem cobra caro e entrega rápido.
Do outro lado, a Xiaomi lançou o MiMo-V2.5 há 12 dias (em 22 de abril) com uma proposta oposta: US$ 0,28 por milhão de tokens de saída, pesos abertos e 1,05 milhão de tokens de contexto. A diferença de preço é de 50x — não é "mais barato", é outra ordem de grandeza.
Inteligência: o Codex lidera, mas por pouco
No índice de inteligência medido pela Artificial Analysis, o Codex marca 45,5 e o MiMo marca 38,0. Sete pontos e meio de distância em 100. Em outras palavras: o Codex está em segundo lugar no ranking global; o MiMo está em quinto. Quem precisa da resposta mais afiada em raciocínio, o Codex entrega.
Mas observe o detalhe que costuma escapar: o Codex paga caro por essa vantagem. O MiMo é quase 28 vezes mais barato no preço blended (US$ 0,175 contra US$ 4,81 por milhão). Em volume, essa diferença muda a fatura da API no fim do mês.
Modalidade, contexto e o que o release não diz
Aqui está a inversão. O MiMo-V2.5 é nativamente omnimodal — recebe texto, imagem, áudio e vídeo e devolve texto. O Codex trabalha com texto, imagem e arquivo, sem áudio nem vídeo. Para um produto que precisa entender um vídeo de suporte ou transcrever um áudio de reunião, o MiMo-V2.5 é o único dos dois que resolve.
E o contexto: 1.050.000 tokens contra 400.000. O MiMo cabe numa base de código grande inteira; o Codex cabe em parte dela.
| Critério | GPT-5.3-Codex | MiMo-V2.5 |
|---|---|---|
| Índice de inteligência | 45.5 | 38.0 |
| Entrada US$/M | 1.75 | 0.14 |
| Saída US$/M | 14 | 0.28 |
| Contexto | 400k | 1.05M |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 118 | 58 |
| Índice de código | — | 56.8 |
| Índice agêntico | — | 24.4 |
Dois detalhes que merecem ser ditos: o MiMo-V2.5 é de pesos abertos (310B parâmetros totais, 15B ativos) — você pode rodar, ajustar e hospedar por conta própria. E a velocidade do Codex (118,36 tok/s) é mais que o dobro da do MiMo (57,52 tok/s). Em pair programming e agentes que respondem em tempo real, isso pesa.
Quando cada um ganha
O Codex ganha quando você precisa da resposta mais inteligente e mais rápida: pair programming, agentes de codificação agêntica, depuração de bugs complexos onde cada ponto percentual de acurácia vale dinheiro. É o caso onde a fatura mais alta se justifica porque o modelo entrega o que os outros não entregam no catálogo hoje.
O MiMo-V2.5 ganha quando você precisa processar muita informação a baixo custo: análise de bases de código inteiras, sistemas que consomem vídeo ou áudio, workloads de classificação e extração em lote, ou qualquer caso em que 50x mais barato compensa os sete pontos de diferença em inteligência. Para self-hosting, é a única opção dos dois.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
O que você faz com isso amanhã
Se o seu gargalo é qualidade de raciocínio por token, o Codex continua sendo a referência nesta data. Se o gargalo é custo por requisição, multimodalidade ou contexto longo, o MiMo-V2.5 da Xiaomi é a melhor relação custo-benefício acima de IQ 35 que existe no catálogo hoje. E o detalhe que ninguém comenta: rodar o MiMo localmente zera o custo variável de saída — para quem tem GPU sobrando, o cálculo muda de novo.
Use o GPT-5.3-Codex quando cada ponto percentual de acurácia em código vale o preço de US$ 14/M; use o MiMo-V2.5 quando o gargalo é custo, contexto longo ou multimodalidade — e considere self-hosting para zerar o variável de saída.
Perguntas frequentes
GPT-5.3-Codex ou MiMo-V2.5: qual é mais barato?
O MiMo-V2.5 é 50 vezes mais barato no preço de saída — US$ 0,28 contra US$ 14 por milhão de tokens. No preço blended (entrada + saída), a diferença chega a quase 28 vezes. Como o MiMo tem pesos abertos, o custo de inferência pode ainda cair a zero em self-hosting.
MiMo-V2.5 tem pesos abertos?
Sim. O MiMo-V2.5 da Xiaomi é distribuído com pesos abertos, com 310 bilhões de parâmetros totais e 15 bilhões ativos por inferência. O GPT-5.3-Codex é fechado e roda apenas na API da OpenAI.
Qual dos dois tem mais contexto?
O MiMo-V2.5 suporta 1.050.000 tokens de contexto, contra 400.000 do GPT-5.3-Codex — 2,6 vezes mais. Para code review de monorepo ou análise de bases longas, isso muda a forma de usar o modelo.