Arquivo — 2025-10
56 reportagens neste mês.
Amazon lança Nova Premier 1.0 por US$ 12,50 por milhão de saída — e cobra caro por pouco IQ
O modelo mais capaz da Amazon chega ao catálogo com 1M de contexto, mas fica atrás dos rivais em inteligência e cobra mais que o Claude Haiku 4.5
Amazon Nova Premier custa 96 vezes mais que um rival open-weight mais esperto
Amazon apresenta o Nova Premier como multimodal mais avançado do portfólio Nova e 'melhor professor para destilação'. No IQ, porém, fica abaixo de um 21B open-weight que custa 1% do preço de saída do Premier.
Sonar Pro Search estreia a US$ 15 por milhão de tokens sem nota de inteligência publicada
Mais caro que o3 e Claude Haiku 4.5 no token de saída, o novo modo de busca agentiva da Perplexity chega exclusivo na OpenRouter sem benchmark que sustente o preço.
OpenAI lança modelo de segurança 26x mais barato que o3
gpt-oss-safeguard-20b chega como classificador especializado a US$ 0,30 por milhão de tokens de saída, mas o catálogo não publica nota de inteligência geral para ele
MiniMax M2 cobra US$ 1 o milhão e promete 'quase fronteira' — sem nota
Modelo MoE de 230B foca em código e agentes. Seis dias após o lançamento, o catálogo ainda não publicou benchmark.
Nemotron Nano 12B 2 VL: o multimodal da NVIDIA que custa US$ 0,30 por milhão de tokens blended
Modelo de 13 bilhões de parâmetros com arquitetura híbrida Transformer-Mamba entra no catálogo no mesmo dia em que o topo do mercado segue dominado por o3 e Claude Haiku 4.5.
NVIDIA lança Nemotron Nano 12B 2 VL por US$ 0,60 por milhão de saída
Modelo multimodal de 12B com arquitetura híbrida Transformer-Mamba chega com versão gratuita e mira o segmento pequeno de visão e vídeo.
Qwen3 Next 80B A3B Instruct cobra 4× menos na saída que o Nemotron Super 49B
Dois modelos abertos com quase a mesma nota de inteligência, mas contas de API bem diferentes — e a velocidade também não empata.
Qwen3 VL 32B Instruct chega por US$ 0,42 o milhão de saída
Modelo multimodal chinês de 32B quer brigar com Claude Haiku e GPT-OSS em visão — sem benchmark público de IA no catálogo.
Três lançamentos em sete dias e nenhum corte de preço
IBM, Qwen e MiniMax estreiam modelos entre 20 e 26 de outubro; o catálogo não mexeu em preço e o topo da tabela continua o mesmo.
Phi 4 Mini Instruct: barato no input, sem nota de IQ
Microsoft colocou US$ 0,08 por milhão de tokens no catálogo sem publicar IQ, coding nem agentic — e essa ausência é o ponto.
GPT-5 Image Mini cobra US$ 2 por imagem e mira no chão do multimodal
Versão enxuta do GPT Image 1 Mini chega ao catálogo nove dias depois do lançamento — útil para gerar imagem em escala, irrelevante se você só quer texto.
Llama 4 Maverick cobra 42% menos que o Nemotron 70B e ainda entrega o dobro de inteligência
Comparativo entre dois pesos-pesados abertos da Meta e da NVIDIA mostra que tamanho de catálogo não é argumento quando a conta fecha no fim do mês.
14 vezes mais barato, quase o dobro de inteligência: Maverick contra Command A
Em preço, contexto, multimodalidade e velocidade o modelo da Meta vence. O canadense só se sustenta onde a Cohere já é parte do stack.
Claude Haiku 4.5 em modo batch custa um quinto do Sonnet; vale migrar?
A Anthropic lançou a versão assíncrona do Haiku 4.5 há nove dias. O preço é agressivo — mas o que entrega de inteligência?
Qwen3 VL 32B Instruct custa 5% do preço do Claude Haiku 4.5
Modelo multimodal chinês de 32B chega ao catálogo com entrada de US$ 0,104 e saída de US$ 0,416 por milhão de tokens — mas sem nota de inteligência publicada.
MiniMax M2 chega a US$ 1,02 por milhão mirando código e agentes
Modelo da MiniMax entra mirando Claude Haiku 4.5 e o3 no segmento de agentes, com preço de saída quase cinco vezes menor mas sem IQ publicado
Qwen3 VL 8B Thinking cobra caro para pensar em imagem
Oito dias após o lançamento, o modelo multimodal de raciocínio da Qwen chega com preço de categoria premium e sem nota pública de inteligência para comparar.
Haiku 4.5 cobra 30 vezes mais caro que gpt-oss-120b — vale a diferença?
Anthropic vende fronteira a US$ 5 por milhão de tokens; OpenAI dá modelo aberto por US$ 0,17. O teste de hoje mostra em qual fila cada um entra.
Qwen3 VL 8B custa pouco, mas não entrega o que o nome sugere
O multimodal barato da Qwen chega sete dias depois do lançamento com janela gigante e preço de modelo pequeno — só que a conta nem sempre fecha.