FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (29)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

758 reportagens desde setembro de 2025.

Análise

1 milhão de tokens não impressiona mais — o que importa agora é o preço

No recorte de janelas longas, Scout cobra US$ 0,30 e Nova Premier, US$ 12,50 por milhão de tokens de saída — mesma janela, preços 41 vezes diferentes.

Análise

Qwen3 Next 80B Instruct custa quase o dobro do Nemotron Nano 12B VL — mas entrega 56% mais IQ

Comparativo frente a frente entre dois modelos abertos lançados em menos de 60 dias: quem ganha em texto puro, quem ganha em multimodal, e por que a conta da API não fecha sozinha.

Análise

Pesos abertos já respondem por 15 dos 270 modelos do catálogo — e o mais barato custa US$ 0,13

OpenAI, Meta, Qwen e NVIDIA disputam um nicho que saiu da promessa e entrou na conta da API.

Análise

ERNIE 4.5 cobra 64% mais caro na entrada e ainda perde em IQ

Os dois modelos chineses cobram US$ 1,10 por milhão de tokens de saída. A diferença mora no que entra — e o índice de inteligência também não ajuda a Baidu.

Preços

Cache de prompt: 113 modelos vendem o mesmo atalho por preços 25 vezes diferentes

A leitura de cache aparece em 4 de cada 10 modelos do catálogo e a diferença entre o mais barato e o mais caro não segue a lógica do preço de saída

Análise

Qwen3 Next 80B custa 64% menos que Llama 3.3 70B na saída

Dois modelos abertos, preços e inteligências bem diferentes — e a conta de API não mente.

Retrospectiva

Uma semana, um lançamento e o silêncio que importa

Entre 3 e 9 de novembro o catálogo quase não se mexeu: um único modelo novo entrou, e o topo do ranking continua o mesmo de antes.

Análise

Qwen3 Next 80B é 34% mais inteligente, mas 3,6x mais caro na saída

Mesmo preço de entrada, mesmo open weights — a diferença mora no token de saída e no tamanho da janela

Análise

Amazon Nova Premier cobra 11 vezes mais que o Qwen3 Next Instruct

Em inteligência medida, o Qwen vence por pouco. Em preço, por muito. Em janela de contexto e multimodalidade, a Amazon se destaca. Veja em que cenário cada um compensa o investimento.

Análise

111 modelos leem imagem, vídeo e áudio — e o mais caro não é o melhor

No recorte multimodal do catálogo, o topo de inteligência custa o triplo da melhor razão custo/benefício. A escolha prática está em outro lugar.

Análise

Por que MoE com 117B custa só US$ 0,17 por milhão de tokens

Porque só 5,1 bilhões de parâmetros ligam por token. Sete MoE estão no catálogo hoje — e os dois da OpenAI entregam o melhor IQ por dólar do recorte.

Análise

Sete modelos MoE no catálogo, e o mais barato deles custa centavos

Mistura de especialistas virou o padrão de quem quer baratear a conta sem abrir mão de raciocínio — mas só três dos sete modelos do recorte são de raciocínio.

Análise

Kimi K2 Thinking custa US$ 2,50 por milhão de saída — e a comparação muda tudo

Modelo de raciocínio da MoonshotAI chega ao mesmo dia em que o catálogo mostra 270 modelos ativos e a faixa dos US$ 8 já virou referência entre os modelos que pensam.

Análise

Kimi K2 Thinking estreia por US$ 0,60 o milhão de tokens de entrada: vale para quem?

Modelo de raciocínio da Moonshot AI chega ao catálogo com contexto de 262 mil tokens, cobrança separada para cache e proposta de agente de longo horizonte — mas não traz índice de inteligência nem preço aberto.

Análise

Maverick cobra US$ 0,70; Nova Premier, US$ 12,50 — qual vale o que cobra

Mesmo com IQ menor, o Llama 4 da Meta custa quase 18 vezes menos por milhão de tokens de saída que o topo de linha da Amazon.

Preços

75 modelos abaixo de US$ 0,40: o que a faixa barata do catálogo entrega hoje

Mais de um quarto dos modelos do catálogo custa menos de US$ 0,40 por milhão de tokens de saída. A pergunta é quanto de inteligência você leva por esse dinheiro.

Análise

gpt-oss-20b custa 13 cents; Nemotron Nano 2 VL custa 60. E aí?

Dois modelos abertos da mesma geração, preços muito diferentes, e uma escolha que não se resume a centavos por milhão de tokens.

Análise

Oito modelos de raciocínio custam de US$ 0,07 a US$ 3,50 por milhão de tokens

A fronteira é OpenAI e Anthropic. O melhor custo por ponto de inteligência está nos pesos abertos — e três dos oito são da NVIDIA.

Análise

Nova Premier 1.0 custa 96x mais e marca menos em inteligência que o gpt-oss-20b

O multimodal mais recente da Amazon entra no catálogo acima do o3 em preço de saída e fica abaixo do gpt-oss-20b da OpenAI no índice da Artificial Analysis.

Análise

Voxtral Small 24B custa 30 centavos por áudio: vale o que cobra?

O modelo de áudio da Mistral chega 4 dias depois do lançamento cobrando US$ 0,10 de entrada e US$ 0,30 de saída — barato para transcrição, mas sem nota de QI publicada.

← anteriores página 32 de 38 próximas →