FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (20)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

749 reportagens desde setembro de 2025.

Lançamentos

GPT-5.4 Image 2 cobra US$ 15 por milhão e não publica nota de inteligência

Modelo multimodal da OpenAI é mais caro que o Gemini 3.1 Pro Preview e o GPT-5.3-Codex e entra no catálogo sem benchmark de IQ.

Lançamentos

Ling-2.6-flash entra cobrando 400 vezes menos que o Gemini 3.1 Pro Preview

Modelo estreia a US$ 0,03 por milhão de tokens de saída e sem nota de inteligência publicada no catálogo

Lançamentos

Kimi K2.6 chega cobrando US$ 4 por milhão de saída — e abre família gratuita

MoonshotAI lança o K2.6 multimodal focado em coding longo e multi-agente, com variante gratuita no mesmo dia. O preço de saída cabe entre o MiMo da Xiaomi e o Gemini Pro da Google.

Lançamentos

Baidu lança OCR a US$ 0,68 por milhão de entrada — e grátis na porta de trás

Qianfan-OCR-Fast chega hoje em duas versões: uma paga e outra com tarifa zero, mirando o gargalo de quem digitaliza documento em escala.

Análise

Opus 4.6 Fast custa 6x mais caro e o catálogo não mediu o IQ

Anthropic lança variante rápida do Opus 4.6 com preço premium, sem benchmark de inteligência e concorrendo com Gemini 3.1 Pro e GPT-5.3-Codex no topo.

Retrospectiva

Semana de um lançamento só: Anthropic coloca Opus 4.7 no catálogo

O catálogo fechou a semana com 392 modelos e nenhum corte de preço — só a Anthropic mexeu, duas vezes, no mesmo produto.

Análise

Gemma 4 custa 14× menos que Haiku 4.5 por milhão de tokens

O Gemma 4 é multimodal com vídeo, mais barato e tem pesos abertos. O Haiku 4.5 cobra quase 15× mais, mas entrega quase 50% a mais em agentic — vale para fluxos longos.

Análise

GLM 5.1 mira coding longo a US$ 3 por milhão, sem score público

Lançado há onze dias pela Z.ai, o modelo entra no catálogo vazio de IQ, coding e agentic score — só com descrição ambiciosa e cache entre os mais baratos.

Análise

Mesmo QI, conta 15 vezes menor no embate Haiku 4.5 e Gemma 4 31B

Os dois modelos entregam inteligência praticamente idêntica, mas cobram preços em universos distintos — e cada um abre portas que o outro não abre.

Análise

Gemma 4 26B gratuito tem 262 mil de contexto e nenhum benchmark publicado

É multimodal de imagem e vídeo, custa US$ 0 de entrada e saída, e a Google não publicou índice de inteligência, coding nem agentic.

Análise

Gemma 4 31B batch custa centavos e abre 256K de contexto

Modelo da Google chega em modo assíncrono com preço de fundo de poço — mas sem nota de inteligência publicada, ele vira coringa só para quem sabe o que está comprando.

Análise

Gemma 4 31B é grátis, mas o catálogo não mediu seu QI

Trinta bilhões de parâmetros do Google DeepMind, 256K de contexto e multimodalidade — sem benchmark público e sem nota de inteligência para comparar.

Análise

o3 cobra US$ 8 por milhão; Gemma 4 26B cobra US$ 0,34 — vale a troca?

Comparativo frente a frente mostra uma diferença de 23x no preço de saída e 5 pontos de IQ entre os dois modelos da OpenAI e do Google.

Análise

o3 um ano depois: ainda vale pagar 23× o preço do Gemma 4 31B?

Veterano da OpenAI cobra US$ 8 por milhão de tokens de saída; o modelo de 30,7B do Google, lançado há doze dias, cobra US$ 0,34 e devolve a diferença em janela de contexto, multimodalidade e pesos abertos.

Análise

o3 cobra 23 vezes mais que o Gemma 4 31B por 4,5% de IQ

O Gemma 4 31B não vence só no preço — também abre vídeo, libera os 30,7 bilhões de parâmetros para download e estica a janela de contexto. O o3 só leva a melhor quando o ser humano está esperando o próximo token.

Análise

GLM 5V Turbo chegou há 12 dias e ainda não publicou nenhum benchmark

Z.ai diz que é o primeiro modelo agente multimodal nativo. A pergunta é se os US$ 4 por milhão de saída compensam a ausência de nota de IQ.

Análise

Qwen 122B é 26% mais inteligente que Gemma 26B — e custa 7x mais

Dois modelos abertos e multimodais disputam o meio do mercado em abril de 2026. O chinês leva em código e agente; o americano, em volume barato.

Análise

Grok 4.20 Multi-Agent cobra US$ 2,50 por milhão, mas não tem IQ publicado

Lançado há 12 dias pela SpaceXAI, o modelo chega como peça de orquestração agentic com preço competitivo, mas sem nota de inteligência, coding ou agentic no catálogo atual.

Retrospectiva

Dois lançamentos no mesmo dia, 50 vezes de distância no preço

Z.ai publicou GLM 5.1 a US$ 3 por milhão de tokens de saída; Anthropic respondeu com Claude Opus 4.6 Fast a US$ 150 em 7 de abril.

Análise

Gemma 4 31B custa 7 vezes menos que Qwen3.5-122B na saída

Dois modelos abertos multimodal com a mesma janela de 256K, mas preços e perfis de uso bem diferentes.

← anteriores página 16 de 38 próximas →