Arquivo
749 reportagens desde setembro de 2025.
GLM 5.2 da Z.ai chega a US$ 3 por milhão de saída e encosta nos grandes
Modelo chinês de 753 bilhões de parâmetros tem nota de inteligência 52,6 e custa quase 17 vezes menos que o Claude Fable 5 no token de saída.
Gemini 3.1 Pro Preview custa 3,5× o Kimi K2.7 Code — vale a diferença?
Comparativo frente a frente entre o modelo mais caro da Google e o coding-focused chinês que estreou três dias antes deste artigo.
Nemotron 3.5 Content Safety é grátis — e isso muda a conta da sua API
NVIDIA lança guardrail multimodal sem custo de inferência; o que sobra no orçamento quando moderação deixa de pesar na fatura.
Nemotron 3 Ultra de graça: o que sobra quando o preço é zero
A NVIDIA abriu o cofre do modelo de raciocínio mais parrudo que tem — mas sem benchmark, sem contexto e sem preço de tabela, vale pra quem?
Nemotron 3 Ultra batch custa R$? O preço que a NVIDIA não grita no release
A versão batch do novo modelo MoE da NVIDIA sai por US$ 3,60 por milhão de tokens de saída — e o detalhe promocional é o que muda a conta.
OpenRouter lança Fusion e deixa o preço em branco no catálogo
A nova função não é um modelo — é uma camada que dispara vários em paralelo. A fatura, porém, continua imprevisível.
Kimi K2.7 Code cobra US$ 3,40 por milhão e perde na régua chinesa de coding
Modelo open-weights de 1 trilhão de parâmetros da MoonshotAI chega com coding 60,76 — e três rivais chineses já entregam o mesmo por uma fração do preço.
Kimi K2.7 Code lidera coding entre MoE chineses, mas cobra US$ 3,40 por saída
Com IQ 43,02, o modelo da MoonshotAI vence os pares chineses no coding score por menos de um ponto — mas o preço de saída o coloca num nicho que não atrai nem quem busca custo nem quem busca o topo.
Codex cobra quase 6× mais que Nemotron 3 Ultra por token de saída
Mesmo com IQ maior, o modelo da OpenAI perde da NVIDIA em preço e em janela de contexto para a maioria dos projetos.
M3 free da MiniMax custa zero e senta na mesa dos caros
Lançado há onze dias, o tier gratuito do M3 entrega o mesmo IQ do plano pago e força uma comparação incômoda com Claude Fable 5, Gemini 3.5 Flash e DeepSeek V4 Pro.
A 62 pontos de IQ, Claude Fable 5 cobra US$ 50 por milhão de saída
O modelo mais inteligente do catálogo estreia com preço de topo e deixa claro quando a conta não compensa
GPT-5.3-Codex custa 11 vezes mais que o Qwen3.7 Plus por token de saída
Codex cobra US$ 14 por milhão de tokens de saída; Qwen3.7 Plus cobra US$ 1,28. O que separa os dois vai além do índice de inteligência.
Claude Fable Latest cobra US$ 50 por milhão de saída e não traz nota de inteligência
Um alias para o Claude Fable 5 com a mesma janela de um milhão de tokens, mas sem benchmark publicado — e o preço de topo do catálogo
Claude Fable 5 chega a US$ 50 por milhão de saída e destrava 62 de IQ
Anthropic põe a família inteira no ar hoje; o flagship custa 4x o Gemini 3.5 Flash e entrega o dobro de inteligência no índice atual.
Nex AGI solta modelo de 397B grátis, mas IQ não entra no top 5
Versão gratuita do Nex-N2-Pro traz pesos abertos, multimodal e a maior nota de coding entre pesos abertos recentes. Para o topo de inteligência, o caminho segue em Gemini 3.1 Pro e GPT-5.3-Codex.
Grátis, chinês e com 397B de parâmetros: o que o Nex-N2-Pro entrega de verdade
Modelo MoE da Nex AGI estreia como opção open weights e preço zero — mas o índice de inteligência 41,7 fica abaixo do pelotão que importa.
MiniMax M3 batch entra no top 4 de QI cobrando US$ 1,20 o milhão
Modelo multimodal de 524 mil tokens fica a 0,13 ponto do DeepSeek V4 Pro e cobra um sétimo do Gemini Flash.
MiniMax M3 batch: o mais barato acima de IQ 45, sem tempo real
A versão assíncrona do M3 custa US$ 1,20 por milhão de tokens de saída — fica abaixo do DeepSeek V4 Pro e do Gemini 3.5 Flash, mas só serve para jobs em fila.
GPT-5.3-Codex cobra 12x mais caro por 0,1 ponto de IQ à frente
Lançado há menos de uma semana, o MiniMax M3 cobra US$ 1,20 por milhão de tokens de saída — onde a OpenAI cobra US$ 14,00. A diferença de inteligência cabe numa casa decimal.
Claude Opus 4.8 batch cobra metade e ainda não tem nota
Anthropic corta o preço do Opus 4.8 pela metade no modo batch, mas o catálogo não publica IQ, velocidade nem país — e isso muda o cálculo.