FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (29)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

758 reportagens desde setembro de 2025.

Análise

Raciocínio de US$ 8 por milhão de tokens: o3 lidera um recorte de oito

O catálogo guarda 279 modelos; só oito são de raciocínio. Metade vem dos EUA, três são da NVIDIA, e o preço de saída varia 62 vezes.

Análise

Amazon Nova Premier cobra 17x mais que o Llama 3.3 70B, mas entrega mais inteligência

Dois modelos com mais de um ano de diferença de lançamento disputam a faixa de US$ 1 a US$ 13 por milhão de tokens de saída. Vale pagar o ágio?

Análise

Nova Premier cobra 41 vezes mais que o Llama 4 Scout — vale?

Amazon e Meta disputam o segmento multimodal de texto e imagem com propostas opostas: capacidade máxima contra preço mínimo.

Lançamentos

Olmo 3 32B Think chega por US$ 0,50 por milhão de tokens de saída

Modelo de raciocínio da AllenAI entra no catálogo custando menos de um terço do Claude Haiku 4.5 — mas sem índice de inteligência publicado até agora.

Lançamentos

Gemini 3 Pro Image Preview chega a US$ 12 por milhão de saída

Google coloca no catálogo o Nano Banana Pro, herdeiro do modelo de imagem viral, com preço de texto e contexto de 65k — sem índice de inteligência divulgado.

Análise

Gemini 3 Pro Imagem estreia a US$ 12 por milhão de saída: vale o que cobra

O novo modelo de imagem do Google chega caro e sem benchmark de raciocínio — só faz sentido para quem realmente precisa gerar e editar imagem com linguagem.

Análise

Grok 4.1 Fast custa metade do Claude Haiku 4.5

xAI entra na briga dos modelos agentic com 2 milhões de contexto e preço de commodity — mas sem nota de inteligência medida.

Lançamentos

Grok 4.1 Fast custa 16 vezes menos que o3 por token de saída

xAI entra no catálogo com modelo agente a US$ 0,50/M de saída e 2M de contexto, mas o índice de inteligência ainda não foi medido

Análise

GPT-5.1 custa US$ 10 por milhão e ainda não tem nota de inteligência

Cinco dias após o lançamento, o modelo topo de linha da OpenAI segue sem índice publicado no catálogo — e cobra US$ 2 a mais por milhão de saída do que o o3, que lidera a régua.

Análise

Amazon Nova Premier cobra 31 vezes mais que o Nemotron e entrega IQ quase igual

Comparativo frente a frente entre dois modelos lançados em outubro de 2025 mostra que o preço, e não a capacidade, decide a escolha.

Análise

Qwen3 Next 80B custa 9% do Nemotron 70B e responde quase 4x mais rápido

Dois modelos abertos, preços em ordens de grandeza diferentes e uma escolha que cabe no bolso de quem paga a API.

Análise

GPT-5.1 batch custou US$ 4,40 por milhão de saída — vale o que sobra da fila?

A OpenAI oferece o modelo top em modo assíncrono a um quinto do preço cheio, mas só se você aceitar esperar e não medir inteligência.

Análise

GPT-5.1 Chat cobra US$ 10 por milhão de saída: vale o troco contra o3?

Três dias após o lançamento, o Instant da nova família da OpenAI ainda não tem índice de inteligência publicado — e isso muda quem deveria cogitá-lo.

Retrospectiva

OpenAI despejou cinco GPT-5.1 em três dias e ninguém falou em corte de preço

A semana foi da OpenAI: cinco variantes do GPT-5.1, um modelo da Deep Cogito e zero mudanças de tabela — o que isso diz sobre a estratégia da empresa.

Análise

GPT-5.1-Codex cobra US$ 10 por milhão de saída: vale para quem?

Versão focada em código da OpenAI estreia com janela de 400 mil tokens e preço oito vezes maior que o do o3, que lidera o ranking de inteligência.

Análise

Qwen3 Next 80B Instruct cobra menos que Command A e entrega quase o dobro de inteligência

Mesmo com 3 bilhões de parâmetros ativos contra 111 bilhões do rival canadense, o modelo chinês vence em IQ, velocidade e preço por token de saída.

Análise

GPT-5.1-Codex-Mini: mais barato que o3, mas sem QI no catálogo

Lançado ontem pela OpenAI, o modelo menor da linha Codex cobra US$ 0,03 por milhão em cache hit. O catálogo ainda não tem nota de inteligência, score de código ou índice agentic para ele.

Análise

Qwen3 Next 80B A3B cobra 7x mais que Nemotron Nano 9B V2

Dois modelos abertos lançados com seis dias de diferença em setembro. Qwen tem quase 60% mais inteligência e cobra US$ 1,10 por milhão na saída; Nemotron cobra US$ 0,16 e tem modo raciocínio nativo.

Lançamentos

OpenAI lança GPT-5.1-Codex a US$ 10 por milhão de tokens de saída

Versão especializada em código estreia ao mesmo preço do GPT-5.1 padrão e mais cara que o o3, seu rival interno de raciocínio.

Lançamentos

Cogito v2.1 671B a US$ 1,25/M: o que o marketing não entrega

O catálogo não publicou índice de inteligência para o modelo. O preço, simétrico e abaixo do Haiku 4.5 e do o3, já está tabelado.

← anteriores página 31 de 38 próximas →