Arquivo
758 reportagens desde setembro de 2025.
Nova 2 Lite custa quase o quádruplo do Maverick por saída de token
Amazon turbina o modelo de entrada e cobra caro pelo milagre; Meta segue barato e aberto, mas perde em inteligência.
Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI
Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.
Seed 1.6 Flash custa o mesmo que o topo do ranking — e ninguém mediu o QI dele
ByteDance joga na faixa dos US$ 0,30 por milhão de tokens de saída, igual ao MiMo da Xiaomi, mas sem benchmark público de inteligência para comparar.
Nova 2 Lite custa 12,5× mais que Nemotron Nano no token de saída
Amazon e NVIDIA lançaram modelos de raciocínio em dezembro. Um entrega multimodalidade e contexto gigante, o outro entrega preço quase dez vezes menor e pesos abertos.
Seed 1.6 aceita vídeo por US$ 2 — mas sem QI publicado
Modelo multimodal da ByteDance Seed entrou há oito dias com 256K de contexto. A conta é convidativa; o catálogo ainda não mediu.
Amazon Nova 2 Lite cobra 19 vezes mais na saída que o gpt-oss-20b da OpenAI
Dois modelos norte-americanos de baixo custo, mas o preço por token de saída revela quem mira produção em escala e quem mira economia de verdade.
MiniMax M2.1: 7 dias de mercado e zero benchmark publicado
Lançado em 23 de dezembro focado em coding e agentes, o modelo entra no catálogo com IQ, coding e agentic em branco — e a régua de comparação passa a ser o preço.
Nova 2 Lite custa 2,3× mais que INTELLECT-3 por token de saída
Amazon entrega multimodal e contexto de 1 milhão; Prime Intellect responde com pesos abertos e 107B parâmetros. O preço mais alto da Nova 2 Lite só se justifica se você usa câmera nem roda modelo local.
GLM 4.7 estreou há sete dias sem nota de inteligência — vale trocar de provedor?
Z.ai promete agente e programação mais estáveis; enquanto o catálogo não medir, a comparação com Claude Haiku 4.5 e Xiaomi MiMo-V2-Flash fica por conta do release.
Nova 2 Lite custa 67% mais que Mistral Large 3 — e perde em raciocínio
Amazon cobra US$ 2,50 por milhão de tokens de saída contra US$ 1,50 do modelo francês, que ainda abre o peso e tem contexto quatro vezes menor. O comparativo que faltava para fechar o ano.
Quatro lançamentos em sete dias e todos abaixo de US$ 2 por milhão de tokens
Z.ai, MiniMax e ByteDance Seed colocaram modelos novos na corrida de preços baixos — sem mexer no topo do ranking de inteligência.
Gemini 3 Flash Preview cobra US$ 3 o milhão e ainda não tem nota de QI
Lançado há 11 dias, o modelo multimodal da Google entra no meio do bolo entre Claude Haiku 4.5 e a Xiaomi MiMo — sem índice de inteligência publicado até agora.
Gemini 3 Flash batch é 70% mais barato que o Haiku, mas só se você pode esperar
Dez dias depois do lançamento, o endpoint assíncrono do Google cobra US$ 1,50 por milhão de saída e abre 1 milhão de contexto — sem benchmark público de IQ para comparar.
Devstral 2 2512 e Nemotron Super 49B: qual vale os 400 dólares por milhão
Dois modelos abertos com mesmo preço de entrada, mas filosofias opostas: 123B da Mistral contra 49B da NVIDIA, e a conta não fecha igual.
Devstral 2 custa 6 vezes menos que Nova Premier e entrega mais IQ
Comparativo entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra quem ganha em código, em contexto e em preço por token.
Devstral 2 cobra seis vezes menos que o Nova Premier — e entrega mais
Comparativo frente a frente entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra que preço nem sempre é o melhor indicador de capacidade.
Devstral 2 cobra 4x mais caro no input que o Qwen3 Next
Dois modelos abertos, sem raciocínio, 256K de contexto. O da Mistral é especialista em código; o da Alibaba é generalista rápido e barato.
GPT-5.2 Chat cobra US$ 14 por milhão de saída: vale pelo resto?
O membro "leve" da família 5.2 chega sem benchmark público e preço de modelo premium — o que ele entrega de fato para quem paga a API.
Devstral 2 custa quase 3× mais e quase dobra o Llama 4 em código
Mistral mira agentes de código com o Devstral 2; Meta responde com multimodal, 1M de contexto e preço bem menor no Maverick.
GPT-5.2 Pro cobra US$ 168 por milhão de tokens — vale o salto?
Para três perfis de uso o preço se justifica, mas a maioria das tarefas tem alternativa até 560 vezes mais barata dentro do próprio catálogo.