FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-12

61 reportagens neste mês.

Análise

Seed 1.6 aceita vídeo por US$ 2 — mas sem QI publicado

Modelo multimodal da ByteDance Seed entrou há oito dias com 256K de contexto. A conta é convidativa; o catálogo ainda não mediu.

Análise

Amazon Nova 2 Lite cobra 19 vezes mais na saída que o gpt-oss-20b da OpenAI

Dois modelos norte-americanos de baixo custo, mas o preço por token de saída revela quem mira produção em escala e quem mira economia de verdade.

Análise

Nova 2 Lite custa 2,3× mais que INTELLECT-3 por token de saída

Amazon entrega multimodal e contexto de 1 milhão; Prime Intellect responde com pesos abertos e 107B parâmetros. O preço mais alto da Nova 2 Lite só se justifica se você usa câmera nem roda modelo local.

Análise

MiniMax M2.1: 7 dias de mercado e zero benchmark publicado

Lançado em 23 de dezembro focado em coding e agentes, o modelo entra no catálogo com IQ, coding e agentic em branco — e a régua de comparação passa a ser o preço.

Análise

GLM 4.7 estreou há sete dias sem nota de inteligência — vale trocar de provedor?

Z.ai promete agente e programação mais estáveis; enquanto o catálogo não medir, a comparação com Claude Haiku 4.5 e Xiaomi MiMo-V2-Flash fica por conta do release.

Análise

Nova 2 Lite custa 67% mais que Mistral Large 3 — e perde em raciocínio

Amazon cobra US$ 2,50 por milhão de tokens de saída contra US$ 1,50 do modelo francês, que ainda abre o peso e tem contexto quatro vezes menor. O comparativo que faltava para fechar o ano.

Mercado

Quatro lançamentos em sete dias e todos abaixo de US$ 2 por milhão de tokens

Z.ai, MiniMax e ByteDance Seed colocaram modelos novos na corrida de preços baixos — sem mexer no topo do ranking de inteligência.

Análise

Gemini 3 Flash Preview cobra US$ 3 o milhão e ainda não tem nota de QI

Lançado há 11 dias, o modelo multimodal da Google entra no meio do bolo entre Claude Haiku 4.5 e a Xiaomi MiMo — sem índice de inteligência publicado até agora.

Análise

Devstral 2 2512 e Nemotron Super 49B: qual vale os 400 dólares por milhão

Dois modelos abertos com mesmo preço de entrada, mas filosofias opostas: 123B da Mistral contra 49B da NVIDIA, e a conta não fecha igual.

Análise

Gemini 3 Flash batch é 70% mais barato que o Haiku, mas só se você pode esperar

Dez dias depois do lançamento, o endpoint assíncrono do Google cobra US$ 1,50 por milhão de saída e abre 1 milhão de contexto — sem benchmark público de IQ para comparar.

Análise

Devstral 2 custa 6 vezes menos que Nova Premier e entrega mais IQ

Comparativo entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra quem ganha em código, em contexto e em preço por token.

Análise

Devstral 2 cobra seis vezes menos que o Nova Premier — e entrega mais

Comparativo frente a frente entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra que preço nem sempre é o melhor indicador de capacidade.

Análise

Devstral 2 cobra 4x mais caro no input que o Qwen3 Next

Dois modelos abertos, sem raciocínio, 256K de contexto. O da Mistral é especialista em código; o da Alibaba é generalista rápido e barato.

Análise

GPT-5.2 Chat cobra US$ 14 por milhão de saída: vale pelo resto?

O membro "leve" da família 5.2 chega sem benchmark público e preço de modelo premium — o que ele entrega de fato para quem paga a API.

Análise

GPT-5.2 Pro cobra US$ 168 por milhão de tokens — vale o salto?

Para três perfis de uso o preço se justifica, mas a maioria das tarefas tem alternativa até 560 vezes mais barata dentro do próprio catálogo.

Análise

Devstral 2 custa quase 3× mais e quase dobra o Llama 4 em código

Mistral mira agentes de código com o Devstral 2; Meta responde com multimodal, 1M de contexto e preço bem menor no Maverick.

Lançamentos

MiniMax M2.1 chega cobrando US$ 0,30 de entrada e US$ 1,20 de saída

Modelo leve, com 10 bilhões de parâmetros ativados, mira coding e fluxos agentic. Promete 'state-of-the-art', mas o catálogo ainda não publicou o índice de inteligência — fica a dúvida para quem escolhe no escuro.

Lançamentos

ByteDance Seed 1.6 cobra US$ 2 por milhão de saída e entra direto no jogo dos grandes

Modelo multimodal com 256K de contexto chega ao mesmo preço do o3 da OpenAI e quatro vezes mais barato na entrada do que o Claude Haiku 4.5.

Lançamentos

GLM 4.7 chega a US$ 1,75 por milhão, entre o o3 e o MiMo

Novo flagship da Z.ai entra sem nota de inteligência publicada no catálogo — a decisão sobre a qualidade fica para o seu próprio teste em pipelines de agente.

Análise

GPT-5.2 Pro batch cobra US$ 84 por milhão de saída: vale o desconto?

A OpenAI cortou metade do preço no modo batch, mas o modelo continua entre os mais caros do catálogo — e sem nota de inteligência publicada.

página 1 de 4 próximas →