FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-07

57 reportagens neste mês.

Lançamentos

LongCat 2.0 da Meituan chega a US$ 1,20 por milhão de saída e abre os pesos

Modelo sparse MoE de 1,6T parâmetros com apenas 48B ativos foca em coding e tarefas agentic; rivaliza em preço com o MiniMax M3 mas fica longe do topo em inteligência.

Preços

GLM 5.2 quase quadruplica de preço num dia, e Z.ai já recua

Qwen3 Thinking também dobrou hoje; dos três cortes registrados, só um pesa de verdade

Retrospectiva

Sete dias, sete modelos: semana termina com 89 mudanças de preço e um router automático

Entre Kimi K3 da chinesa MoonshotAI e o Auto Router da OpenRouter, o catálogo ganhou 7 novidades em 7 dias — e 26 cortes de preço

Preços

Qwen3 14B derruba preço de saída em 74%; Gemma 4 31B encarece 49%

Em um único dia, o catálogo registrou cortes agressivos em modelos chineses e aumentos em Google e MiniMax — e isso muda o cálculo de quem paga a fatura da API.

Benchmarks

Qwen3.5 perde ponto no índice da Artificial Analysis

Versão de 0,8B cai quase um ponto de IQ; a de 35B A3B sobe pouco. Quem já tinha escolhido pelo número precisa reabrir a planilha.

Preços

Qwen3 14B ficou quase 4 vezes mais caro de um dia para o outro

Enquanto Z.ai cortou pela metade o GLM 5.2 e o Google barateou o Gemma 4 31B, dois modelos da Qwen subiram sem aviso claro.

Lançamentos

Thinking Machines lança Inkling com 975B; rivais entregam mais IQ por menos dinheiro

Modelo multimodal de pesos abertos da Thinking Machines chega com 975 bilhões de parâmetros e preço de US$ 4,05 por milhão de tokens de saída. Para a conta de API, há alternativas mais baratas que pontuam mais alto no índice de inteligência.

Lançamentos

Thinking Machines lança Inkling de 975B; rivais a US$ 1,20 já ganham em IQ

Open-weights, multimodal e com 1M de contexto, o modelo entra no catálogo com cache a US$ 0,17 — mas a defesa do Inkling não é o preço da API.

Preços

Kimi Latest fica 4,4× mais caro e iguala preço do Kimi K3

Se você usava o modelo barato da MoonshotAI como entrada de baixo custo, a conta de hoje vai chegar diferente. O Kimi K3, que era mais caro, agora custa a mesma coisa.

Lançamentos

Kimi K3 cobra US$ 15 por milhão de tokens — um terço do Claude Fable 5

Modelo aberto de 2,8T de parâmetros da MoonshotAI entra com IQ 59,7 e abre a briga com o GPT-5.6 Sol pela faixa de IQ 60.

Benchmarks

LongCat 2.0 estreia no índice com IQ 33 e sem preço publicado

Modelo chinês entra na régua da Artificial Analysis abaixo da linha dos 45 e sem valor de API divulgado — fica difícil comparar o que não tem cotação.

Preços

37 modelos mexem no preço em 24h: 26 sobem, 6 caem

Gemma 3 27B e Llama 3.1 8B quase triplicam o custo de saída. Qwen3 Coder é o único corte relevante entre os grandes.

Benchmarks

Hy3-preview estreia abaixo da régua mínima do índice

Novo modelo de raciocínio entra hoje no catálogo da Artificial Analysis com IQ 33,6 e preço de US$ 4,40 por milhão de saída — longe do topo e abaixo do piso competitivo.

Análise

GPT-5.6 Sol entrega 98% do Fable a um quinto do preço

O novo flagship da OpenAI lidera o ranking de coding e empurra o Claude Sonnet 5 para a faixa intermediária.

Análise

GPT-5.6 Sol custa um quinto do Fable 5 com quase o mesmo IQ

O segundo modelo mais inteligente do catálogo ganha do próprio irmão da OpenAI em preço e vence o Sonnet 5 no mesmo patamar de cobrança.

Preços

Qwen3 235B ficou 5,5 vezes mais caro em um único ajuste

Preço de saída saltou de US$ 0,10 para US$ 0,55 por milhão de tokens. No dia, foram 4 reajustes para cima e apenas 1 para baixo.

Retrospectiva

OpenAI lançou 12 modelos em um dia: a semana que mexeu 32 preços

Sol, Terra e Luna chegaram juntos com versões batch e Pro, e o saldo de sete dias mostra um mercado em rearranjo constante, com cortes e altas quase empatados.

Benchmarks

Dois modelos abertos perdem nota de inteligência na régua de julho

Gemma 4 31B e MiMo-V2.5 caem cerca de 3 pontos no índice do catálogo; o preço não mudou e o custo-benefício continua de pé.

Benchmarks

Muse Spark 1.1 estreia a US$ 2 com IQ 50; GLM-5.2 fica abaixo da régua

Os dois modelos que entraram hoje no Artificial Analysis. Um compete na faixa dos mais baratos com IQ acima de 50; o outro cobra mais caro e pontua menos que alternativas abaixo de US$ 2.

Preços

Z.ai derruba GLM 5.2 em 25% e três modelos chineses ficam mais baratos

Nenhum laboratório americano entrou na lista de cortes do dia. A queda veio toda da China, e o movimento diz algo sobre quem está brigando por preço agora.

← anteriores página 2 de 3 próximas →