Arquivo — 2025-12
61 reportagens neste mês.
GPT-5.2 custa US$ 14 por milhão de saída: vale o que a OpenAI cobrou?
Onze dias após o lançamento, o flagship da OpenAI entra no catálogo com preço de fronteira e sem benchmark público — o que isso diz para quem paga a API.
Semana quieta termina com Gemini 3 Flash Preview em duas versões
Sete dias sem corte de preço e só dois lançamentos, ambos do Google — e a conta continua subindo no mesmo ritmo.
Nemotron Nano custa 10× menos que Devstral 2 e a nota cai junto
Comparativo frente a frente entre os dois modelos open-weights lançados em dezembro para codificação agentic — quando cada um compensa de verdade.
GPT-5.2 batch custa US$ 7 por milhão e ainda não tem IQ publicado
Dez dias depois do lançamento, o modo assíncrono do novo modelo da OpenAI entra num mercado em que o Xiaomi MiMo lidera o ranking de inteligência medida por um quarto do preço.
GLM 4.6V custa barato, mas o catálogo ainda não tem nota de QI
Modelo multimodal da Z.ai entra com preço competitivo, 128K de contexto e benchmark em branco onze dias depois do lançamento.
Devstral 2 cobra US$ 2 por milhão de saída e ainda assim custa mais que o gpt-oss-20b
Um modelo de 125B parâmetros da Mistral contra um MoE de 21B da OpenAI: a conta não fecha do jeito que parece.
Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída
O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.
GPT-5.1-Codex-Max a US$ 10 por milhão: vale pagar caro por código?
Modelo agentic da OpenAI chega caro e sem benchmark público; o tabuleiro de dezembro mostra quem entrega mais inteligência por menos.
Ministral 3 8B batch da Mistral cobra preço único nos dois lados
Modelo de 8 bilhões de parâmetros com visão e contexto de 262k chega por US$ 0,075 por milhão de token — entrada e saída. Onde ele se encaixa e onde não.
Gemini 3 Flash Preview custa US$ 3 por milhão de saída e mira o o3
Google lança versão preview do Flash com raciocínio próximo ao Pro, contexto de 1M e preço 60% menor que o o3 da OpenAI.
Xiaomi MiMo-V2-Flash custa 16 vezes menos que Claude Haiku 4.5
O modelo chinês de 309B parâmetros lidera o índice de inteligência do dia e cobra US$ 0,30 por milhão de tokens de saída — contra US$ 5 do Haiku.
Nemotron 3 Nano 30B: rápido, mas pior em código que o gpt-oss-20b
O modelo MoE de pesos abertos da NVIDIA entrega 2,2x a velocidade do rival em inteligência intermediária, mas perde 30% em benchmarks de programação.
MiMo-V2-Flash assume topo do índice por 27 vezes menos na saída
Modelo open-source da Xiaomi estreou no índice Artificial Analysis com 34,02 pontos; o3, segundo colocado, cobra US$ 8 por milhão de tokens de saída.
MiMo-V2-Flash da Xiaomi custa 27 vezes menos que o o3
Modelo aberto da Xiaomi entra no topo do índice de inteligência com preço de saída de US$ 0,30 por milhão de tokens e bate de frente com Haiku 4.5 e o3.
Xiaomi lança MiMo-V2-Flash a US$ 0,30 por milhão de saída e lidera o catálogo
Modelo open-weights de 309B parâmetros custa 26 vezes menos que o o3 da OpenAI por token de saída.
Nemotron 3 Nano custa US$ 0,20 por milhão de saída — e é open weights
NVIDIA lança MoE de 31,6B com só 3,6B ativos por token; inteligência fica abaixo do top 5, mas o preço mexe no chão do mercado
Devstral 2 2512 cobra 67% a mais que o Qwen3 Next em saída
Os dois são modelos abertos disputando a faixa dos US$ 1 a US$ 2 por milhão de tokens de saída. Em código e agentic o francês ganha por larga margem — mas o chinês é 70% mais rápido e custa quase metade.
Mistral Large 3 2512 batch: 41B ativos por US$ 0,75 de saída
Modelo sparse MoE da Mistral chega em variante batch com janela de 256k e preço agressivo, mas sem benchmark de inteligência publicado.
Devstral 2 e Nova 2 Lite empatam no IQ e dividem a conta diferente
Dois modelos com nota quase idêntica, preços parecidos e promessas opostas: código agente da Mistral contra multimodal barato da Amazon.
DeepSeek V3.2 Speciale custa 11 dias depois: vale o que cobra
Variante de alta computação da DeepSeek chega com preço agressivo, mas sem nota de inteligência no catálogo — e é justamente aí que mora a dúvida.