FalaVIP IA o que os modelos custam,
medido todo dia
Preços

Pareto estreia com 262k de contexto; DeepSeek e Kimi barateiam

O modelo da unbiased custa US$ 2,50 na entrada e US$ 7,50 na saída. No mesmo período, o DeepSeek V4 Pro e o Kimi K3 tiveram cortes de até 41,1% e 27%, respectivamente.

Redação FalaVIP IA 4 min de leitura
262.144 tokensjanela de contexto do Pareto
US$ 2,50por milhão de tokens de entrada
US$ 7,50por milhão de tokens de saída

Se você usa um modelo em produção, o número mais importante do Pareto não é a janela de 262.144 tokens. É o preço: US$ 2,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída, segundo os preços listados no OpenRouter.

Isso coloca o modelo da unbiased acima de opções com contexto maior e tarifa menor. O Qwen3.8 Max, por exemplo, aparece com 1.000.000 de tokens de contexto, US$ 2 por milhão na entrada e US$ 6 na saída. O Gemini 3.8 Flash chega a 1.048.576 tokens, com US$ 0,75 na entrada e US$ 3,75 na saída.

O Pareto estreou em 17 de setembro. A mudança, portanto, não é uma redução de custo nem uma expansão de contexto para a faixa de um milhão de tokens. É a chegada de mais uma opção intermediária para quem precisa de uma janela longa, mas aceita pagar mais por ela.

O que mudou na fatura

O OpenRouter lista o Pareto a US$ 2,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. O cache aparece a US$ 0,25 por milhão de tokens.

Para uma aplicação que envia documentos extensos e recebe respostas curtas, a entrada pesa mais na conta. Para agentes que produzem muito texto, código ou chamadas intermediárias, a saída de US$ 7,50 merece atenção especial. O preço não deve ser comparado apenas pela janela de contexto: a proporção entre tokens enviados e gerados define o impacto real na fatura.

Há também uma alternativa gratuita com a mesma janela: o Union Alpha, da stealth, aparece com 262.144 tokens de contexto e custo zero na entrada e na saída. Mas não há notas de inteligência, código ou desempenho agêntico registradas para nenhum dos dois modelos. O preço, sozinho, não permite tratar as opções como equivalentes.

DeepSeek e Kimi mexem nos valores

A principal pressão competitiva vem de modelos já conhecidos. O DeepSeek V4 Pro 0813 passou de US$ 2,95 para US$ 1,738 por milhão de tokens, uma queda de 41,1%, conforme os preços do OpenRouter. O DeepSeek V4 Pro 0423 caiu de US$ 3,20 para US$ 1,887, redução de 41%.

O Kimi K3 também ficou mais barato: de US$ 15 para US$ 10,95 por milhão de tokens, queda de 27%. Mesmo depois do corte, continua muito acima do Pareto no preço nominal. A comparação, porém, não diz qual modelo entrega melhor resultado: o Artificial Analysis não registra nota de inteligência, código ou uso agêntico para o Pareto nos dados disponíveis.

O movimento não foi uniforme. O DeepSeek V3 caiu de US$ 1,029 para US$ 0,89, enquanto o DeepSeek V4 Flash 0423 aparece com uma alta de US$ 0,14 para US$ 0,177 em um registro de 18 de setembro. Isso reforça que o nome da família não basta para prever o preço: é preciso conferir a versão exata e a data da tarifa.

Há inconsistência no histórico do V4 Pro

Os registros do DeepSeek V4 Pro 0813 não formam uma série perfeitamente limpa. Em 17 de setembro, o modelo aparece tanto com uma alta de US$ 1,738 para US$ 1,98 quanto com uma redução de US$ 1,976 para US$ 1,742. Em outro registro, a tarifa parte de US$ 2,95 e chega a US$ 1,738.

No dia seguinte, há novamente um registro de US$ 1,738 para US$ 1,98, ao lado do corte de US$ 2,95 para US$ 1,738. A conclusão segura é que houve alterações relevantes nos preços listados, mas não que exista uma única trajetória histórica sem conflitos para essa variante.

Para quem escolhe modelo por custo, isso muda o procedimento: a versão precisa ser fixada no roteador e a tarifa deve ser verificada antes de comparar estimativas. Um preço promocional ou uma atualização de variante pode inverter a decisão sem qualquer mudança no código da aplicação.

Para quem o Pareto faz sentido

O Pareto interessa a quem precisa de 262.144 tokens de contexto e quer testar um modelo novo sem saltar para tarifas de US$ 10 ou US$ 20 por milhão de tokens. Também pode servir para fluxos em que a janela longa é mais importante que o menor custo possível.

Ele não muda muito para quem já opera com o Gemini 3.8 Flash ou com o Qwen3.8 Max. Esses modelos oferecem janelas de 1.000.000 de tokens por preços menores nos valores listados no OpenRouter. Para workloads sensíveis à fatura, o Pareto também não é a escolha óbvia diante de alternativas como o Union Alpha ou modelos gratuitos do catálogo.

O resultado prático é menos espetacular do que a cifra de 262k sugere: o Pareto amplia a lista de modelos longos, mas chega com uma conta que exige justificativa por qualidade ou comportamento específico. Sem benchmark registrado no Artificial Analysis, essa justificativa ainda precisa vir de testes na própria aplicação.

Em uma frase

Se a janela de 262.144 tokens não for indispensável, compare primeiro o Pareto com modelos de contexto maior e tarifa menor antes de colocá-lo em produção.

Perguntas frequentes

Quanto custa o Pareto na API?

O Pareto custa US$ 2,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída no OpenRouter. O cache aparece a US$ 0,25 por milhão de tokens.

Qual é a janela de contexto do Pareto?

A janela de contexto é de 262.144 tokens. O Union Alpha também aparece com 262.144 tokens, enquanto o Qwen3.8 Max e o Gemini 3.8 Flash têm janelas de 1.000.000 e 1.048.576 tokens, respectivamente.

O DeepSeek V4 Pro ficou mais barato?

Sim, os registros do OpenRouter mostram cortes de 41,1% no DeepSeek V4 Pro 0813 e de 41% no V4 Pro 0423. Há registros conflitantes para a variante 0813, então a versão e a tarifa precisam ser conferidas antes da comparação.

Leia também