quarta-feira, 8 de outubro 2025
2 reportagemsAnálise
Llama 4 Maverick custa 5x mais que Nemotron Nano 9B V2 e não raciocina
O modelo da Meta tem 1M de contexto e aceita imagem, mas o da NVIDIA cobra uma fração do preço e entrega raciocínio nativo.
Análise
GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída
Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.