FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.3-Codex a US$ 14 ou MiMo-V2.5 a US$ 0,28 por milhão de tokens?

O Codex lidera em inteligência e velocidade. O MiMo responde com 50x mais barato, contexto 2,6x maior e pesos abertos. Cada um ganha num cenário — e a conta decide.

Redação FalaVIP IA 3 min de leitura
US$ 14 vs US$ 0,28por milhão de tokens de saída (50x de diferença)
1.050.000 vs 400.000tokens de contexto (2,6x mais no MiMo)
118,36 vs 57,52 tok/svelocidade de geração (Codex mais que o dobro)

A conta que o release não mostra

A OpenAI apresenta o GPT-5.3-Codex como o "modelo de codificação agêntica mais avançado" da casa. O que o release não coloca em destaque é o preço de saída: US$ 14 por milhão de tokens. A 118 tokens por segundo, é a referência para quem cobra caro e entrega rápido.

Do outro lado, a Xiaomi lançou o MiMo-V2.5 há 12 dias (em 22 de abril) com uma proposta oposta: US$ 0,28 por milhão de tokens de saída, pesos abertos e 1,05 milhão de tokens de contexto. A diferença de preço é de 50x — não é "mais barato", é outra ordem de grandeza.

Inteligência: o Codex lidera, mas por pouco

No índice de inteligência medido pela Artificial Analysis, o Codex marca 45,5 e o MiMo marca 38,0. Sete pontos e meio de distância em 100. Em outras palavras: o Codex está em segundo lugar no ranking global; o MiMo está em quinto. Quem precisa da resposta mais afiada em raciocínio, o Codex entrega.

Índice de inteligência (Artificial Analysis)
GPT-5.3-Codex45,5MiMo-V2.538índice
Fonte: Artificial Analysis

Mas observe o detalhe que costuma escapar: o Codex paga caro por essa vantagem. O MiMo é quase 28 vezes mais barato no preço blended (US$ 0,175 contra US$ 4,81 por milhão). Em volume, essa diferença muda a fatura da API no fim do mês.

Modalidade, contexto e o que o release não diz

Aqui está a inversão. O MiMo-V2.5 é nativamente omnimodal — recebe texto, imagem, áudio e vídeo e devolve texto. O Codex trabalha com texto, imagem e arquivo, sem áudio nem vídeo. Para um produto que precisa entender um vídeo de suporte ou transcrever um áudio de reunião, o MiMo-V2.5 é o único dos dois que resolve.

E o contexto: 1.050.000 tokens contra 400.000. O MiMo cabe numa base de código grande inteira; o Codex cabe em parte dela.

GPT-5.3-Codex × MiMo-V2.5
CritérioGPT-5.3-CodexMiMo-V2.5
Índice de inteligência45.538.0
Entrada US$/M1.750.14
Saída US$/M140.28
Contexto400k1.05M
Pesos abertosnãosim
Velocidade (tok/s)11858
Índice de código56.8
Índice agêntico24.4

Dois detalhes que merecem ser ditos: o MiMo-V2.5 é de pesos abertos (310B parâmetros totais, 15B ativos) — você pode rodar, ajustar e hospedar por conta própria. E a velocidade do Codex (118,36 tok/s) é mais que o dobro da do MiMo (57,52 tok/s). Em pair programming e agentes que respondem em tempo real, isso pesa.

Preço de saída (US$ por milhão de tokens)
GPT-5.3-Codex14MiMo-V2.50,28US$/M
Fonte: OpenRouter

Quando cada um ganha

O Codex ganha quando você precisa da resposta mais inteligente e mais rápida: pair programming, agentes de codificação agêntica, depuração de bugs complexos onde cada ponto percentual de acurácia vale dinheiro. É o caso onde a fatura mais alta se justifica porque o modelo entrega o que os outros não entregam no catálogo hoje.

O MiMo-V2.5 ganha quando você precisa processar muita informação a baixo custo: análise de bases de código inteiras, sistemas que consomem vídeo ou áudio, workloads de classificação e extração em lote, ou qualquer caso em que 50x mais barato compensa os sete pontos de diferença em inteligência. Para self-hosting, é a única opção dos dois.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 435 modelos disponíveis no catálogo nesta data.

O que você faz com isso amanhã

Se o seu gargalo é qualidade de raciocínio por token, o Codex continua sendo a referência nesta data. Se o gargalo é custo por requisição, multimodalidade ou contexto longo, o MiMo-V2.5 da Xiaomi é a melhor relação custo-benefício acima de IQ 35 que existe no catálogo hoje. E o detalhe que ninguém comenta: rodar o MiMo localmente zera o custo variável de saída — para quem tem GPU sobrando, o cálculo muda de novo.

Em uma frase

Use o GPT-5.3-Codex quando cada ponto percentual de acurácia em código vale o preço de US$ 14/M; use o MiMo-V2.5 quando o gargalo é custo, contexto longo ou multimodalidade — e considere self-hosting para zerar o variável de saída.

Perguntas frequentes

GPT-5.3-Codex ou MiMo-V2.5: qual é mais barato?

O MiMo-V2.5 é 50 vezes mais barato no preço de saída — US$ 0,28 contra US$ 14 por milhão de tokens. No preço blended (entrada + saída), a diferença chega a quase 28 vezes. Como o MiMo tem pesos abertos, o custo de inferência pode ainda cair a zero em self-hosting.

MiMo-V2.5 tem pesos abertos?

Sim. O MiMo-V2.5 da Xiaomi é distribuído com pesos abertos, com 310 bilhões de parâmetros totais e 15 bilhões ativos por inferência. O GPT-5.3-Codex é fechado e roda apenas na API da OpenAI.

Qual dos dois tem mais contexto?

O MiMo-V2.5 suporta 1.050.000 tokens de contexto, contra 400.000 do GPT-5.3-Codex — 2,6 vezes mais. Para code review de monorepo ou análise de bases longas, isso muda a forma de usar o modelo.

Leia também