FalaVIP IA quinta-feira, 03 de setembro de 2026

Preços

63 reportagens de preços sobre modelos de inteligência artificial.

Preços

Tencent Hy3 sobe 38% em um dia e vira o reajuste mais agressivo do catálogo

Dois modelos ficaram mais caros e um ficou mais barato em 7 de julho; o Hy3 da Tencent liderou o aumento e o Llama 3.2 3B da Meta liderou o corte

Preços

M2.7 da MiniMax zerou; GLM 5.2 da Z.ai subiu 58% no mesmo dia

Três mudanças em um único dia expõem como o preço de modelo de IA virou variável diária — e onde a conta de API dói mais.

Preços

GLM 5.2 da Z.ai ficou 21% mais barato em dois cortes seguidos

Modelo chinês de alto IQ derruba preço de saída pela segunda vez em 24 horas e entra no radar de quem paga a conta da API

Preços

Qwen3 Thinking quase 15x mais caro em um dia, Sonnet Latest derruba preço

Seis reajustes para cima e três para baixo mexem no cardápio desta terça; o que muda de verdade na conta de quem já roda Qwen ou Sonnet em produção.

Preços

Kimi K2.6 ficou 6% mais barato e ninguém mexeu no resto

Dois cortes e dois ajustes cosméticos no catálogo desta segunda-feira — o que muda de verdade na conta de quem já roda Kimi em produção.

Preços

Qwen3.6 27B fica 16% mais barato na saída e já é o modelo chinês mais em conta acima de IQ 45

Única mudança de preço do dia em um catálogo de 477 modelos; corte acontece no token de saída, enquanto a entrada segue em US$ 0,2885 por milhão.

Preços

Cinco modelos ficaram mais baratos e um ficou mais caro em 24 horas

Repasse de preço do dia derruba saída do MiniMax M2.5 pela metade e mexe em seis modelos — vale trocar de cavalo?

Preços

Nex-N2-Pro cai 60% no output enquanto Kimi K2.7 Code sobe 11%

O corte no modelo da Nex AGI e o aumento no da MoonshotAI mexem no meio do tabuleiro — onde a briga por workloads de produção realmente acontece.

Preços

GLM 5.2 derruba 23% no preço de saída e vira o melhor custo-benefício acima de IQ 50

Quatro modelos ficaram mais baratos em 22 de junho; nenhum subiu. A Z.ai liderou o corte e empurrou o GLM 5.2 para o topo da lista de quem busca inteligência por dólar.

Preços

Cinco modelos mexeram no preço hoje; três ficaram mais baratos

Tencent Hy3, Kimi K2.7 Code e Trinity Large Thinking lideram os cortes do dia — e revelam quem está brigando por volume.

Preços

GPT-5.3-Codex custa 11 vezes mais que o Qwen3.7 Plus por token de saída

Codex cobra US$ 14 por milhão de tokens de saída; Qwen3.7 Plus cobra US$ 1,28. O que separa os dois vai além do índice de inteligência.

Preços

GPT-5.3-Codex cobra 12x mais caro por 0,1 ponto de IQ à frente

Lançado há menos de uma semana, o MiniMax M3 cobra US$ 1,20 por milhão de tokens de saída — onde a OpenAI cobra US$ 14,00. A diferença de inteligência cabe numa casa decimal.

Preços

Haiku 4.5 custa quase 7× mais caro que Mercury 2 no token de saída

Quase seis meses separam os dois lançamentos da Anthropic e da Inception — e a conta de API mostra quem paga pelo silêncio do raciocínio.

Preços

Cache do OpenAI o3 custa 50 vezes o do Xiaomi MiMo

Mesmo serviço para reusar um prompt já processado: a diferença vai de zero desconto a US$ 0,01 por milhão de tokens. Quase metade do catálogo está nesse jogo.

Preços

89 modelos custam menos de US$ 1 por milhão de tokens — e poucos valem a pena

A faixa barata do catálogo concentra modelos open-weight de China, EUA e França, mas só três entregam inteligência competitiva; Xiaomi, OpenAI e NVIDIA dominam a conversa.

Preços

Mistral Large 3 custa 7,5x mais que o Nemotron Nano por token de saída

Os dois são modelos abertos lançados em dezembro; o francês pesa 11x mais em parâmetros ativos, mas o americano é 3x mais rápido e tem raciocínio nativo.

Preços

Cache de prompt custa 10% do preço de entrada em 141 modelos

Dois em cada três modelos do catálogo cobram cache a um décimo do token de input — e isso muda a conta de quem repete contexto.

Preços

8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece

A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.

Preços

Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI

Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.

Preços

Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída

O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.

← anteriores página 3 de 4 próximas →