FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-06

52 reportagens neste mês.

Análise

GLM 5.2 cobra 25% do Gemini 3.1 Pro e quase dobra nota em agente

Lançado há três dias, o modelo chinês da Z.ai empata em código e custa US$ 3 por milhão de tokens de saída — mas o Gemini ainda leva em multimodalidade, velocidade e recall.

Análise

Kimi K2.7 Code de graça: vale substituir seu modelo pago por uma semana?

Lançado há sete dias, o coding-focused da MoonshotAI entra no catálogo com preço zero — e contexto de 262 mil tokens. A pergunta é se isso muda alguma coisa na sua fila de produção.

Lançamentos

Google cobra US$ 12 por milhão de tokens no novo Nano Banana Pro

Modelo de imagem topo de linha da Gemini 3 Pro chega ao catálogo pelo mesmo preço de saída do Gemini 3.1 Pro Preview e quatro vezes mais caro que o Nano Banana 2

Análise

Claude Fable 5 em modo batch custa cinco vezes menos que o Claude Fable 5 normal

A Anthropic cortou o preço do topo do ranking para quem aceita esperar — e isso muda o cálculo de qual modelo colocar em produção.

Análise

Cohere estreia a família North com modelo de código grátis — e ele não compete pelo topo

North Mini Code chega com 30B de parâmetros, raciocínio ligado e preço zero. A pergunta é para quem ele serve de verdade.

Lançamentos

Cohere lança North Mini Code grátis com 30B de parâmetros e abre a família North

Modelo de codificação agentic estreia com pesos abertos, contexto de 256 mil tokens e preço zero — mas o índice de inteligência fica bem abaixo dos concorrentes pagos.

Análise

GLM 5.2 entra em segundo no ranking de inteligência custando 6% do líder

Modelo chinês de pesos abertos da Z.ai supera Gemini Pro e Flash em IQ e em preço por token de saída; veja quando migrar e quando o multimodal do Google ainda vale a fatura.

Lançamentos

GLM 5.2 da Z.ai chega a US$ 3 por milhão de saída e encosta nos grandes

Modelo chinês de 753 bilhões de parâmetros tem nota de inteligência 52,6 e custa quase 17 vezes menos que o Claude Fable 5 no token de saída.

Análise

Nemotron 3.5 Content Safety é grátis — e isso muda a conta da sua API

NVIDIA lança guardrail multimodal sem custo de inferência; o que sobra no orçamento quando moderação deixa de pesar na fatura.

Análise

Gemini 3.1 Pro Preview custa 3,5× o Kimi K2.7 Code — vale a diferença?

Comparativo frente a frente entre o modelo mais caro da Google e o coding-focused chinês que estreou três dias antes deste artigo.

Análise

Nemotron 3 Ultra de graça: o que sobra quando o preço é zero

A NVIDIA abriu o cofre do modelo de raciocínio mais parrudo que tem — mas sem benchmark, sem contexto e sem preço de tabela, vale pra quem?

Lançamentos

OpenRouter lança Fusion e deixa o preço em branco no catálogo

A nova função não é um modelo — é uma camada que dispara vários em paralelo. A fatura, porém, continua imprevisível.

Análise

Nemotron 3 Ultra batch custa R$? O preço que a NVIDIA não grita no release

A versão batch do novo modelo MoE da NVIDIA sai por US$ 3,60 por milhão de tokens de saída — e o detalhe promocional é o que muda a conta.

Análise

Kimi K2.7 Code lidera coding entre MoE chineses, mas cobra US$ 3,40 por saída

Com IQ 43,02, o modelo da MoonshotAI vence os pares chineses no coding score por menos de um ponto — mas o preço de saída o coloca num nicho que não atrai nem quem busca custo nem quem busca o topo.

Análise

Kimi K2.7 Code cobra US$ 3,40 por milhão e perde na régua chinesa de coding

Modelo open-weights de 1 trilhão de parâmetros da MoonshotAI chega com coding 60,76 — e três rivais chineses já entregam o mesmo por uma fração do preço.

Análise

Codex cobra quase 6× mais que Nemotron 3 Ultra por token de saída

Mesmo com IQ maior, o modelo da OpenAI perde da NVIDIA em preço e em janela de contexto para a maioria dos projetos.

Análise

M3 free da MiniMax custa zero e senta na mesa dos caros

Lançado há onze dias, o tier gratuito do M3 entrega o mesmo IQ do plano pago e força uma comparação incômoda com Claude Fable 5, Gemini 3.5 Flash e DeepSeek V4 Pro.

Análise

A 62 pontos de IQ, Claude Fable 5 cobra US$ 50 por milhão de saída

O modelo mais inteligente do catálogo estreia com preço de topo e deixa claro quando a conta não compensa

Preços

GPT-5.3-Codex custa 11 vezes mais que o Qwen3.7 Plus por token de saída

Codex cobra US$ 14 por milhão de tokens de saída; Qwen3.7 Plus cobra US$ 1,28. O que separa os dois vai além do índice de inteligência.

Lançamentos

Claude Fable Latest cobra US$ 50 por milhão de saída e não traz nota de inteligência

Um alias para o Claude Fable 5 com a mesma janela de um milhão de tokens, mas sem benchmark publicado — e o preço de topo do catálogo

← anteriores página 2 de 3 próximas →