FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (29)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

758 reportagens desde setembro de 2025.

Lançamentos

MiniMax M2.1 chega cobrando US$ 0,30 de entrada e US$ 1,20 de saída

Modelo leve, com 10 bilhões de parâmetros ativados, mira coding e fluxos agentic. Promete 'state-of-the-art', mas o catálogo ainda não publicou o índice de inteligência — fica a dúvida para quem escolhe no escuro.

Lançamentos

ByteDance Seed 1.6 cobra US$ 2 por milhão de saída e entra direto no jogo dos grandes

Modelo multimodal com 256K de contexto chega ao mesmo preço do o3 da OpenAI e quatro vezes mais barato na entrada do que o Claude Haiku 4.5.

Lançamentos

GLM 4.7 chega a US$ 1,75 por milhão, entre o o3 e o MiMo

Novo flagship da Z.ai entra sem nota de inteligência publicada no catálogo — a decisão sobre a qualidade fica para o seu próprio teste em pipelines de agente.

Análise

GPT-5.2 Pro batch cobra US$ 84 por milhão de saída: vale o desconto?

A OpenAI cortou metade do preço no modo batch, mas o modelo continua entre os mais caros do catálogo — e sem nota de inteligência publicada.

Análise

GPT-5.2 custa US$ 14 por milhão de saída: vale o que a OpenAI cobrou?

Onze dias após o lançamento, o flagship da OpenAI entra no catálogo com preço de fronteira e sem benchmark público — o que isso diz para quem paga a API.

Retrospectiva

Semana quieta termina com Gemini 3 Flash Preview em duas versões

Sete dias sem corte de preço e só dois lançamentos, ambos do Google — e a conta continua subindo no mesmo ritmo.

Análise

GPT-5.2 batch custa US$ 7 por milhão e ainda não tem IQ publicado

Dez dias depois do lançamento, o modo assíncrono do novo modelo da OpenAI entra num mercado em que o Xiaomi MiMo lidera o ranking de inteligência medida por um quarto do preço.

Análise

Nemotron Nano custa 10× menos que Devstral 2 e a nota cai junto

Comparativo frente a frente entre os dois modelos open-weights lançados em dezembro para codificação agentic — quando cada um compensa de verdade.

Análise

Devstral 2 cobra US$ 2 por milhão de saída e ainda assim custa mais que o gpt-oss-20b

Um modelo de 125B parâmetros da Mistral contra um MoE de 21B da OpenAI: a conta não fecha do jeito que parece.

Análise

GLM 4.6V custa barato, mas o catálogo ainda não tem nota de QI

Modelo multimodal da Z.ai entra com preço competitivo, 128K de contexto e benchmark em branco onze dias depois do lançamento.

Preços

Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída

O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.

Análise

GPT-5.1-Codex-Max a US$ 10 por milhão: vale pagar caro por código?

Modelo agentic da OpenAI chega caro e sem benchmark público; o tabuleiro de dezembro mostra quem entrega mais inteligência por menos.

Análise

Ministral 3 8B batch da Mistral cobra preço único nos dois lados

Modelo de 8 bilhões de parâmetros com visão e contexto de 262k chega por US$ 0,075 por milhão de token — entrada e saída. Onde ele se encaixa e onde não.

Lançamentos

Gemini 3 Flash Preview custa US$ 3 por milhão de saída e mira o o3

Google lança versão preview do Flash com raciocínio próximo ao Pro, contexto de 1M e preço 60% menor que o o3 da OpenAI.

Análise

Xiaomi MiMo-V2-Flash custa 16 vezes menos que Claude Haiku 4.5

O modelo chinês de 309B parâmetros lidera o índice de inteligência do dia e cobra US$ 0,30 por milhão de tokens de saída — contra US$ 5 do Haiku.

Análise

Nemotron 3 Nano 30B: rápido, mas pior em código que o gpt-oss-20b

O modelo MoE de pesos abertos da NVIDIA entrega 2,2x a velocidade do rival em inteligência intermediária, mas perde 30% em benchmarks de programação.

Análise

MiMo-V2-Flash assume topo do índice por 27 vezes menos na saída

Modelo open-source da Xiaomi estreou no índice Artificial Analysis com 34,02 pontos; o3, segundo colocado, cobra US$ 8 por milhão de tokens de saída.

Análise

MiMo-V2-Flash da Xiaomi custa 27 vezes menos que o o3

Modelo aberto da Xiaomi entra no topo do índice de inteligência com preço de saída de US$ 0,30 por milhão de tokens e bate de frente com Haiku 4.5 e o3.

Lançamentos

Xiaomi lança MiMo-V2-Flash a US$ 0,30 por milhão de saída e lidera o catálogo

Modelo open-weights de 309B parâmetros custa 26 vezes menos que o o3 da OpenAI por token de saída.

Lançamentos

Nemotron 3 Nano custa US$ 0,20 por milhão de saída — e é open weights

NVIDIA lança MoE de 31,6B com só 3,6B ativos por token; inteligência fica abaixo do top 5, mas o preço mexe no chão do mercado

← anteriores página 28 de 38 próximas →