Preços
88 reportagens de preços sobre modelos de inteligência artificial.
Mistral Large 3 custa 7,5x mais que o Nemotron Nano por token de saída
Os dois são modelos abertos lançados em dezembro; o francês pesa 11x mais em parâmetros ativos, mas o americano é 3x mais rápido e tem raciocínio nativo.
Cache de prompt custa 10% do preço de entrada em 141 modelos
Dois em cada três modelos do catálogo cobram cache a um décimo do token de input — e isso muda a conta de quem repete contexto.
8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece
A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.
Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI
Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.
Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída
O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.
Por 1/47 do preço do o3: a faixa barata do catálogo tem 77 modelos
Mais de um quarto dos 281 modelos listados cobra menos de US$ 0,50 por milhão de tokens de saída. O detalhe é o que se entrega por esse preço — e por que a geografia do fornecedor já está decidida.
Cache de prompt: 113 modelos vendem o mesmo atalho por preços 25 vezes diferentes
A leitura de cache aparece em 4 de cada 10 modelos do catálogo e a diferença entre o mais barato e o mais caro não segue a lógica do preço de saída
75 modelos abaixo de US$ 0,40: o que a faixa barata do catálogo entrega hoje
Mais de um quarto dos modelos do catálogo custa menos de US$ 0,40 por milhão de tokens de saída. A pergunta é quanto de inteligência você leva por esse dinheiro.