Preços
63 reportagens de preços sobre modelos de inteligência artificial.
Tencent Hy3 sobe 38% em um dia e vira o reajuste mais agressivo do catálogo
Dois modelos ficaram mais caros e um ficou mais barato em 7 de julho; o Hy3 da Tencent liderou o aumento e o Llama 3.2 3B da Meta liderou o corte
M2.7 da MiniMax zerou; GLM 5.2 da Z.ai subiu 58% no mesmo dia
Três mudanças em um único dia expõem como o preço de modelo de IA virou variável diária — e onde a conta de API dói mais.
GLM 5.2 da Z.ai ficou 21% mais barato em dois cortes seguidos
Modelo chinês de alto IQ derruba preço de saída pela segunda vez em 24 horas e entra no radar de quem paga a conta da API
Qwen3 Thinking quase 15x mais caro em um dia, Sonnet Latest derruba preço
Seis reajustes para cima e três para baixo mexem no cardápio desta terça; o que muda de verdade na conta de quem já roda Qwen ou Sonnet em produção.
Kimi K2.6 ficou 6% mais barato e ninguém mexeu no resto
Dois cortes e dois ajustes cosméticos no catálogo desta segunda-feira — o que muda de verdade na conta de quem já roda Kimi em produção.
Qwen3.6 27B fica 16% mais barato na saída e já é o modelo chinês mais em conta acima de IQ 45
Única mudança de preço do dia em um catálogo de 477 modelos; corte acontece no token de saída, enquanto a entrada segue em US$ 0,2885 por milhão.
Cinco modelos ficaram mais baratos e um ficou mais caro em 24 horas
Repasse de preço do dia derruba saída do MiniMax M2.5 pela metade e mexe em seis modelos — vale trocar de cavalo?
Nex-N2-Pro cai 60% no output enquanto Kimi K2.7 Code sobe 11%
O corte no modelo da Nex AGI e o aumento no da MoonshotAI mexem no meio do tabuleiro — onde a briga por workloads de produção realmente acontece.
GLM 5.2 derruba 23% no preço de saída e vira o melhor custo-benefício acima de IQ 50
Quatro modelos ficaram mais baratos em 22 de junho; nenhum subiu. A Z.ai liderou o corte e empurrou o GLM 5.2 para o topo da lista de quem busca inteligência por dólar.
Cinco modelos mexeram no preço hoje; três ficaram mais baratos
Tencent Hy3, Kimi K2.7 Code e Trinity Large Thinking lideram os cortes do dia — e revelam quem está brigando por volume.
GPT-5.3-Codex custa 11 vezes mais que o Qwen3.7 Plus por token de saída
Codex cobra US$ 14 por milhão de tokens de saída; Qwen3.7 Plus cobra US$ 1,28. O que separa os dois vai além do índice de inteligência.
GPT-5.3-Codex cobra 12x mais caro por 0,1 ponto de IQ à frente
Lançado há menos de uma semana, o MiniMax M3 cobra US$ 1,20 por milhão de tokens de saída — onde a OpenAI cobra US$ 14,00. A diferença de inteligência cabe numa casa decimal.
Haiku 4.5 custa quase 7× mais caro que Mercury 2 no token de saída
Quase seis meses separam os dois lançamentos da Anthropic e da Inception — e a conta de API mostra quem paga pelo silêncio do raciocínio.
Cache do OpenAI o3 custa 50 vezes o do Xiaomi MiMo
Mesmo serviço para reusar um prompt já processado: a diferença vai de zero desconto a US$ 0,01 por milhão de tokens. Quase metade do catálogo está nesse jogo.
89 modelos custam menos de US$ 1 por milhão de tokens — e poucos valem a pena
A faixa barata do catálogo concentra modelos open-weight de China, EUA e França, mas só três entregam inteligência competitiva; Xiaomi, OpenAI e NVIDIA dominam a conversa.
Mistral Large 3 custa 7,5x mais que o Nemotron Nano por token de saída
Os dois são modelos abertos lançados em dezembro; o francês pesa 11x mais em parâmetros ativos, mas o americano é 3x mais rápido e tem raciocínio nativo.
Cache de prompt custa 10% do preço de entrada em 141 modelos
Dois em cada três modelos do catálogo cobram cache a um décimo do token de input — e isso muda a conta de quem repete contexto.
8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece
A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.
Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI
Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.
Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída
O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.