FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-07

57 reportagens neste mês.

Lançamentos

DeepSeek V4 Flash custa 138 vezes menos que Claude Opus 5 por token

Modelo sparse MoE da DeepSeek chega a US$ 0,18 por milhão de tokens de saída e vira o mais barato acima de IQ 45 no catálogo

Benchmarks

Cinco modelos estreiam no índice com IQ entre 11 e 46 — e só dois custam menos de US$ 1

Do topo da régua ao fundo do poço: Kimi K3 low e dois DeepSeek V4 Flash puxam a fila dos baratos, enquanto Celeris-1 entra com nota de um dígito.

Lançamentos

Thinking Machines lança Inkling Small a US$ 1,20 por milhão de tokens de saída

Modelo multimodal com 12B parâmetros ativos vem em três sabores: pago, batch e gratuito; nota de inteligência ainda não foi divulgada.

Preços

OpenAI derruba Luna em 80% e sobe Terra Pro no mesmo dia

Qwen 2.5 7B Instruct dobrou de preço enquanto o GPT-5.6 Luna ficou cinco vezes mais barato — quem roteiriza por tarefa precisa reotimizar hoje.

Preços

Qwen sobe 54% em seis modelos thinking e mexe na conta de quem usa raciocínio

Alta coordenada da família Alibaba atinge variantes de raciocínio e visão; Gemma 4 e um Qwen Instruct foram na contramão e ficaram mais baratos.

Benchmarks

Cinco modelos pequenos reavaliados hoje — a régua dos baratos mexeu

Qwen3.5, Gemma 4 e Ministral 3 tiveram as notas revisadas pelo catálogo nesta segunda. Para quem escolhe pelo custo por chamada, a fila entre os modelos pequenos mexeu.

Preços

Nemotron 3 Ultra oscilou 64% em 28/07 e mais 5 preços mexeram

Qwen3 Coder Next subiu 64% no input e ficou; GLM 5.2 fez ioiô. Veja quem paga mais caro agora e quem voltou ao preço de ontem.

Lançamentos

Qwen3.7 Flash estreia a US$ 0,13 por milhão de tokens, mas sem nota de inteligência

Modelo multimodal da Alibaba chega com 1 milhão de contexto e preço de saída quase 10 vezes menor que a opção mais barata já medida no catálogo.

Preços

OpenAI cortou quatro modelos pela metade em um único dia

Sete modelos ficaram mais baratos ontem. Enquanto OpenAI e MoonshotAI cortam, Z.ai e Google sobem — e sua escolha de API muda.

Preços

DeepSeek V4 Flash sobe 49% em um dia e arrasta a conta

Oito modelos mexeram de preço nas últimas 24 horas, três para cima e três para baixo — e o Flash chinês é o que mais pesa no boleto de quem busca IA barata.

Retrospectiva

Opus 5 assume topo do ranking de IQ a US$ 25 por milhão de tokens

Em uma semana com 12 lançamentos e 64 mudanças de preço, Anthropic estreou no topo enquanto Poolside e InclusionAI entraram pelo chão do catálogo.

Preços

Nemotron 3 Ultra sobe 64% no output em dia de cortes no catálogo

Das onze alterações de preço de hoje, oito foram para baixo — mas o modelo de 550B da NVIDIA foi na contramão e viu o token de saída saltar de US$ 2,20 para US$ 3,60 por milhão.

Benchmarks

Claude Opus 5 estreia em cinco variantes a US$ 10, com 10 pontos de IQ de distância

Adaptive Reasoning da Anthropic cobra o mesmo preço em cinco níveis de esforço; Max Effort empata com GPT-5.6 Sol e sai 60% mais barato que o topo do índice

Benchmarks

Agnes 2.5 Pro Alpha entra a US$ 0,56 por milhão, mas com QI 38,79

A nova entrada do índice da Artificial Analysis custa menos da metade do modelo mais barato acima de QI 45 — e a nota de intelligence mostra o tamanho do trade-off.

Lançamentos

Claude Opus 5 chega a US$ 25 por milhão de saída e assume o topo de inteligência

Anthropic lança o flagship mais caro do topo do ranking e duas variantes no mesmo dia; OpenAI e Moonshot ficam logo atrás no índice de inteligência.

Preços

Qwen3 14B salta 279% no preço de saída em um único dia

Cinco modelos da família Qwen mudaram de preço nas últimas 24 horas. NVIDIA cortou. Veja o que muda na fatura de quem gera muito texto.

Lançamentos

Ling-3.0-flash é 19 vezes mais barato que o rival — e ninguém testou

Modelo MoE de 124B parâmetros da InclusionAI estreia a US$ 0,063 por milhão de tokens de saída, mas o catálogo não traz índice de inteligência nem benchmark publicado.

Benchmarks

Google põe duas variantes do Gemini Flash no índice e cobra caro pela mais forte

Gemini 3.6 Flash (high) estreia com IQ 50 e US$ 3 por milhão de tokens de saída; a versão Lite custa um terço, mas fica fora da régua dos modelos úteis.

Benchmarks

Quatro modelos do catálogo tiveram a nota de benchmark revisada; um deles caiu quase 26%,Quatro notas de benchmark foram revisadas em um dia: o que muda na sua escolha,Quatro modelos reavaliados: Trinity Large Thinking perdeu 6,3 pontos de IQ,Reavaliação do dia derruba nota do Trinity Large Thinking em quase 26%,Quatro modelos reavaliados pelo Artificial Analysis em 22 de julho de 2026,Trinity Large Thinking cai de 24,5 para 18,2 na reavaliação do Artificial Analysis,Quatro notas de benchmark revisadas: Trinity Large Thinking foi o que mais caiu,Reavaliação do Artificial Analysis mexe em quatro modelos do catálogo,Quatro modelos tiveram a régua de benchmark movida pelo Artificial Analysis,Quatro reavaliações do Artificial Analysis em um só dia: o que muda na sua pilha

Trinity Large Thinking perdeu quase 26% da nota em uma só revisão; Gemma 4 E4B e DeepSeek V4 Flash também foram recalibrados.

Lançamentos

Google solta quatro Gemini de uma vez, e o Flash perde em preço

Gemini 3.6 Flash custa US$ 3,75 por milhão de tokens de saída, mas o GPT-5.6 Luna, da OpenAI, cobra US$ 1,20 e marca IQ maior.

página 1 de 3 próximas →