FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (20)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

749 reportagens desde setembro de 2025.

Lançamentos

GLM 5.2 da Z.ai chega a US$ 3 por milhão de saída e encosta nos grandes

Modelo chinês de 753 bilhões de parâmetros tem nota de inteligência 52,6 e custa quase 17 vezes menos que o Claude Fable 5 no token de saída.

Análise

Gemini 3.1 Pro Preview custa 3,5× o Kimi K2.7 Code — vale a diferença?

Comparativo frente a frente entre o modelo mais caro da Google e o coding-focused chinês que estreou três dias antes deste artigo.

Análise

Nemotron 3.5 Content Safety é grátis — e isso muda a conta da sua API

NVIDIA lança guardrail multimodal sem custo de inferência; o que sobra no orçamento quando moderação deixa de pesar na fatura.

Análise

Nemotron 3 Ultra de graça: o que sobra quando o preço é zero

A NVIDIA abriu o cofre do modelo de raciocínio mais parrudo que tem — mas sem benchmark, sem contexto e sem preço de tabela, vale pra quem?

Análise

Nemotron 3 Ultra batch custa R$? O preço que a NVIDIA não grita no release

A versão batch do novo modelo MoE da NVIDIA sai por US$ 3,60 por milhão de tokens de saída — e o detalhe promocional é o que muda a conta.

Lançamentos

OpenRouter lança Fusion e deixa o preço em branco no catálogo

A nova função não é um modelo — é uma camada que dispara vários em paralelo. A fatura, porém, continua imprevisível.

Análise

Kimi K2.7 Code cobra US$ 3,40 por milhão e perde na régua chinesa de coding

Modelo open-weights de 1 trilhão de parâmetros da MoonshotAI chega com coding 60,76 — e três rivais chineses já entregam o mesmo por uma fração do preço.

Análise

Kimi K2.7 Code lidera coding entre MoE chineses, mas cobra US$ 3,40 por saída

Com IQ 43,02, o modelo da MoonshotAI vence os pares chineses no coding score por menos de um ponto — mas o preço de saída o coloca num nicho que não atrai nem quem busca custo nem quem busca o topo.

Análise

Codex cobra quase 6× mais que Nemotron 3 Ultra por token de saída

Mesmo com IQ maior, o modelo da OpenAI perde da NVIDIA em preço e em janela de contexto para a maioria dos projetos.

Análise

M3 free da MiniMax custa zero e senta na mesa dos caros

Lançado há onze dias, o tier gratuito do M3 entrega o mesmo IQ do plano pago e força uma comparação incômoda com Claude Fable 5, Gemini 3.5 Flash e DeepSeek V4 Pro.

Análise

A 62 pontos de IQ, Claude Fable 5 cobra US$ 50 por milhão de saída

O modelo mais inteligente do catálogo estreia com preço de topo e deixa claro quando a conta não compensa

Preços

GPT-5.3-Codex custa 11 vezes mais que o Qwen3.7 Plus por token de saída

Codex cobra US$ 14 por milhão de tokens de saída; Qwen3.7 Plus cobra US$ 1,28. O que separa os dois vai além do índice de inteligência.

Lançamentos

Claude Fable Latest cobra US$ 50 por milhão de saída e não traz nota de inteligência

Um alias para o Claude Fable 5 com a mesma janela de um milhão de tokens, mas sem benchmark publicado — e o preço de topo do catálogo

Lançamentos

Claude Fable 5 chega a US$ 50 por milhão de saída e destrava 62 de IQ

Anthropic põe a família inteira no ar hoje; o flagship custa 4x o Gemini 3.5 Flash e entrega o dobro de inteligência no índice atual.

Lançamentos

Nex AGI solta modelo de 397B grátis, mas IQ não entra no top 5

Versão gratuita do Nex-N2-Pro traz pesos abertos, multimodal e a maior nota de coding entre pesos abertos recentes. Para o topo de inteligência, o caminho segue em Gemini 3.1 Pro e GPT-5.3-Codex.

Análise

Grátis, chinês e com 397B de parâmetros: o que o Nex-N2-Pro entrega de verdade

Modelo MoE da Nex AGI estreia como opção open weights e preço zero — mas o índice de inteligência 41,7 fica abaixo do pelotão que importa.

Análise

MiniMax M3 batch entra no top 4 de QI cobrando US$ 1,20 o milhão

Modelo multimodal de 524 mil tokens fica a 0,13 ponto do DeepSeek V4 Pro e cobra um sétimo do Gemini Flash.

Análise

MiniMax M3 batch: o mais barato acima de IQ 45, sem tempo real

A versão assíncrona do M3 custa US$ 1,20 por milhão de tokens de saída — fica abaixo do DeepSeek V4 Pro e do Gemini 3.5 Flash, mas só serve para jobs em fila.

Preços

GPT-5.3-Codex cobra 12x mais caro por 0,1 ponto de IQ à frente

Lançado há menos de uma semana, o MiniMax M3 cobra US$ 1,20 por milhão de tokens de saída — onde a OpenAI cobra US$ 14,00. A diferença de inteligência cabe numa casa decimal.

Análise

Claude Opus 4.8 batch cobra metade e ainda não tem nota

Anthropic corta o preço do Opus 4.8 pela metade no modo batch, mas o catálogo não publica IQ, velocidade nem país — e isso muda o cálculo.

← anteriores página 11 de 38 próximas →