FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (29)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

758 reportagens desde setembro de 2025.

Retrospectiva

Seis modelos novos e zero corte de preço: a semana dos lançamentos de nicho

Semana trouxe agente de busca a US$ 15 e modelo premium da Amazon a US$ 12,50, mas nenhuma mudança de tabela — o catálogo está se especializando, não se consolidando.

Análise

Por US$ 0,075 a OpenAI quer rodar sua moderação de conteúdo

gpt-oss-safeguard-20b não é um concorrente do o3. É um classificador especializado com 21B parâmetros — e a conta é onde o barato aparece.

Análise

Nova Premier custa 10x mais que Qwen3 Next e ainda fica atrás no IQ

Janela de 1M de tokens e entrada de imagem são os únicos argumentos do modelo da AWS contra um rival chinês mais barato, mais rápido e com índice de inteligência maior.

Análise

Qwen3 Next 80B Thinking custa 10 vezes menos que o novo Nova Premier da Amazon

Lançado ontem nos EUA, o topo da Amazon cobra US$ 12,50 por milhão de tokens de saída — e perde em inteligência para um modelo chinês de código aberto.

Lançamentos

Amazon lança Nova Premier 1.0 por US$ 12,50 por milhão de saída — e cobra caro por pouco IQ

O modelo mais capaz da Amazon chega ao catálogo com 1M de contexto, mas fica atrás dos rivais em inteligência e cobra mais que o Claude Haiku 4.5

Análise

Amazon Nova Premier custa 96 vezes mais que um rival open-weight mais esperto

Amazon apresenta o Nova Premier como multimodal mais avançado do portfólio Nova e 'melhor professor para destilação'. No IQ, porém, fica abaixo de um 21B open-weight que custa 1% do preço de saída do Premier.

Lançamentos

Sonar Pro Search estreia a US$ 15 por milhão de tokens sem nota de inteligência publicada

Mais caro que o3 e Claude Haiku 4.5 no token de saída, o novo modo de busca agentiva da Perplexity chega exclusivo na OpenRouter sem benchmark que sustente o preço.

Análise

MiniMax M2 cobra US$ 1 o milhão e promete 'quase fronteira' — sem nota

Modelo MoE de 230B foca em código e agentes. Seis dias após o lançamento, o catálogo ainda não publicou benchmark.

Lançamentos

OpenAI lança modelo de segurança 26x mais barato que o3

gpt-oss-safeguard-20b chega como classificador especializado a US$ 0,30 por milhão de tokens de saída, mas o catálogo não publica nota de inteligência geral para ele

Análise

Nemotron Nano 12B 2 VL: o multimodal da NVIDIA que custa US$ 0,30 por milhão de tokens blended

Modelo de 13 bilhões de parâmetros com arquitetura híbrida Transformer-Mamba entra no catálogo no mesmo dia em que o topo do mercado segue dominado por o3 e Claude Haiku 4.5.

Lançamentos

NVIDIA lança Nemotron Nano 12B 2 VL por US$ 0,60 por milhão de saída

Modelo multimodal de 12B com arquitetura híbrida Transformer-Mamba chega com versão gratuita e mira o segmento pequeno de visão e vídeo.

Análise

Qwen3 VL 32B Instruct chega por US$ 0,42 o milhão de saída

Modelo multimodal chinês de 32B quer brigar com Claude Haiku e GPT-OSS em visão — sem benchmark público de IA no catálogo.

Análise

Qwen3 Next 80B A3B Instruct cobra menos na saída que o Nemotron Super 49B

Dois modelos abertos com quase a mesma nota de inteligência, mas contas de API bem diferentes — e a velocidade também não empata.

Análise

Phi 4 Mini Instruct: barato no input, sem nota de IQ

Microsoft colocou US$ 0,08 por milhão de tokens no catálogo sem publicar IQ, coding nem agentic — e essa ausência é o ponto.

Retrospectiva

Três lançamentos em sete dias e nenhum corte de preço

IBM, Qwen e MiniMax estreiam modelos entre 20 e 26 de outubro; o catálogo não mexeu em preço e o topo da tabela continua o mesmo.

Análise

Llama 4 Maverick cobra 42% menos que o Nemotron 70B e ainda entrega o dobro de inteligência

Comparativo entre dois pesos-pesados abertos da Meta e da NVIDIA mostra que tamanho de catálogo não é argumento quando a conta fecha no fim do mês.

Análise

GPT-5 Image Mini cobra US$ 2 por imagem e mira no chão do multimodal

Versão enxuta do GPT Image 1 Mini chega ao catálogo nove dias depois do lançamento — útil para gerar imagem em escala, irrelevante se você só quer texto.

Análise

Claude Haiku 4.5 em modo batch custa um quinto do Sonnet; vale migrar?

A Anthropic lançou a versão assíncrona do Haiku 4.5 há nove dias. O preço é agressivo — mas o que entrega de inteligência?

Análise

14 vezes mais barato, quase o dobro de inteligência: Maverick contra Command A

Em preço, contexto, multimodalidade e velocidade o modelo da Meta vence. O canadense só se sustenta onde a Cohere já é parte do stack.

Lançamentos

MiniMax M2 chega a US$ 1,02 por milhão mirando código e agentes

Modelo da MiniMax entra mirando Claude Haiku 4.5 e o3 no segmento de agentes, com preço de saída quase cinco vezes menor mas sem IQ publicado

← anteriores página 33 de 38 próximas →