FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-10

56 reportagens neste mês.

Lançamentos

Amazon lança Nova Premier 1.0 por US$ 12,50 por milhão de saída — e cobra caro por pouco IQ

O modelo mais capaz da Amazon chega ao catálogo com 1M de contexto, mas fica atrás dos rivais em inteligência e cobra mais que o Claude Haiku 4.5

Análise

Amazon Nova Premier custa 96 vezes mais que um rival open-weight mais esperto

Amazon apresenta o Nova Premier como multimodal mais avançado do portfólio Nova e 'melhor professor para destilação'. No IQ, porém, fica abaixo de um 21B open-weight que custa 1% do preço de saída do Premier.

Lançamentos

Sonar Pro Search estreia a US$ 15 por milhão de tokens sem nota de inteligência publicada

Mais caro que o3 e Claude Haiku 4.5 no token de saída, o novo modo de busca agentiva da Perplexity chega exclusivo na OpenRouter sem benchmark que sustente o preço.

Lançamentos

OpenAI lança modelo de segurança 26x mais barato que o3

gpt-oss-safeguard-20b chega como classificador especializado a US$ 0,30 por milhão de tokens de saída, mas o catálogo não publica nota de inteligência geral para ele

Análise

MiniMax M2 cobra US$ 1 o milhão e promete 'quase fronteira' — sem nota

Modelo MoE de 230B foca em código e agentes. Seis dias após o lançamento, o catálogo ainda não publicou benchmark.

Análise

Nemotron Nano 12B 2 VL: o multimodal da NVIDIA que custa US$ 0,30 por milhão de tokens blended

Modelo de 13 bilhões de parâmetros com arquitetura híbrida Transformer-Mamba entra no catálogo no mesmo dia em que o topo do mercado segue dominado por o3 e Claude Haiku 4.5.

Lançamentos

NVIDIA lança Nemotron Nano 12B 2 VL por US$ 0,60 por milhão de saída

Modelo multimodal de 12B com arquitetura híbrida Transformer-Mamba chega com versão gratuita e mira o segmento pequeno de visão e vídeo.

Análise

Qwen3 Next 80B A3B Instruct cobra 4× menos na saída que o Nemotron Super 49B

Dois modelos abertos com quase a mesma nota de inteligência, mas contas de API bem diferentes — e a velocidade também não empata.

Análise

Qwen3 VL 32B Instruct chega por US$ 0,42 o milhão de saída

Modelo multimodal chinês de 32B quer brigar com Claude Haiku e GPT-OSS em visão — sem benchmark público de IA no catálogo.

Retrospectiva

Três lançamentos em sete dias e nenhum corte de preço

IBM, Qwen e MiniMax estreiam modelos entre 20 e 26 de outubro; o catálogo não mexeu em preço e o topo da tabela continua o mesmo.

Análise

Phi 4 Mini Instruct: barato no input, sem nota de IQ

Microsoft colocou US$ 0,08 por milhão de tokens no catálogo sem publicar IQ, coding nem agentic — e essa ausência é o ponto.

Análise

GPT-5 Image Mini cobra US$ 2 por imagem e mira no chão do multimodal

Versão enxuta do GPT Image 1 Mini chega ao catálogo nove dias depois do lançamento — útil para gerar imagem em escala, irrelevante se você só quer texto.

Análise

Llama 4 Maverick cobra 42% menos que o Nemotron 70B e ainda entrega o dobro de inteligência

Comparativo entre dois pesos-pesados abertos da Meta e da NVIDIA mostra que tamanho de catálogo não é argumento quando a conta fecha no fim do mês.

Análise

14 vezes mais barato, quase o dobro de inteligência: Maverick contra Command A

Em preço, contexto, multimodalidade e velocidade o modelo da Meta vence. O canadense só se sustenta onde a Cohere já é parte do stack.

Análise

Claude Haiku 4.5 em modo batch custa um quinto do Sonnet; vale migrar?

A Anthropic lançou a versão assíncrona do Haiku 4.5 há nove dias. O preço é agressivo — mas o que entrega de inteligência?

Lançamentos

Qwen3 VL 32B Instruct custa 5% do preço do Claude Haiku 4.5

Modelo multimodal chinês de 32B chega ao catálogo com entrada de US$ 0,104 e saída de US$ 0,416 por milhão de tokens — mas sem nota de inteligência publicada.

Lançamentos

MiniMax M2 chega a US$ 1,02 por milhão mirando código e agentes

Modelo da MiniMax entra mirando Claude Haiku 4.5 e o3 no segmento de agentes, com preço de saída quase cinco vezes menor mas sem IQ publicado

Análise

Qwen3 VL 8B Thinking cobra caro para pensar em imagem

Oito dias após o lançamento, o modelo multimodal de raciocínio da Qwen chega com preço de categoria premium e sem nota pública de inteligência para comparar.

Análise

Haiku 4.5 cobra 30 vezes mais caro que gpt-oss-120b — vale a diferença?

Anthropic vende fronteira a US$ 5 por milhão de tokens; OpenAI dá modelo aberto por US$ 0,17. O teste de hoje mostra em qual fila cada um entra.

Análise

Qwen3 VL 8B custa pouco, mas não entrega o que o nome sugere

O multimodal barato da Qwen chega sete dias depois do lançamento com janela gigante e preço de modelo pequeno — só que a conta nem sempre fecha.

página 1 de 3 próximas →