FalaVIP IA o que os modelos custam,
medido todo dia
Análise

SWE 2 promete cortar custos, mas o preço ainda não aparece

A alegação de custo equivalente ao Claude Fable 5.1 não pode ser confirmada no catálogo consultado. Os preços disponíveis mostram outra realidade para quem decide o modelo pela fatura.

Redação FalaVIP IA 4 min de leitura
US$ 50por milhão de tokens de saída do Claude Fable 5.1 no OpenRouter
US$ 20preço listado pelo Artificial Analysis para as variantes líderes do Fable 5.1
598modelos catalogados no OpenRouter

A promessa central do SWE 2 é atraente para qualquer equipe que paga por agentes de programação: entregar uma tarefa de engenharia de software com custo semelhante ao Claude Fable 5.1, mas cobrando menos por uso. O problema é que o modelo não aparece nos dados de preços e modelos disponíveis para esta análise. Portanto, a economia anunciada ainda não pode entrar na planilha de produção.

A pauta veio do vídeo “SWE 2 is here! The new Cognition model, is it worth it? (Real-world test)”, do canal Hora de Codar, de Matheus Battisti (YouTube). O material coloca o novo modelo da Cognition, associado à Química 3, como uma opção voltada à engenharia de software. Mas a checagem de preço e desempenho precisa separar a promessa do que está efetivamente disponível.

O que não aparece no catálogo

O catálogo reúne 598 modelos de 71 criadores. Ainda assim, não há uma ficha para Cognition SWE 2, Química 3 ou qualquer entrada que permita conferir preço de entrada, preço de saída, janela de contexto ou notas de programação e uso agêntico.

Isso muda a decisão. Sem preço por token, não dá para transformar a promessa de redução em custo mensal. Sem uma nota de coding ou agentic do Artificial Analysis, também não dá para afirmar que o modelo entrega o mesmo resultado do Fable em tarefas reais. E sem uma métrica de custo por tarefa publicada nos dados, a equivalência anunciada permanece sem confirmação independente.

O ponto não é que o SWE 2 seja caro ou barato. É que, para quem integra uma API, o preço não está disponível na fonte de comparação usada aqui. Um modelo ausente do catálogo pode até ser interessante em uma demonstração, mas ainda não é uma opção precificável para um orçamento.

A conta do Fable tem duas referências

O Claude Fable 5.1 aparece com preços praticados no OpenRouter de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A janela de contexto é de 1 milhão de tokens. Essa é a referência mais direta para estimar a fatura de uma integração.

O Artificial Analysis, por outro lado, lista as variantes de raciocínio do Fable 5.1 entre os modelos no topo de inteligência, com preço de US$ 20 por milhão de tokens. A plataforma também atribui ao modelo notas de inteligência de 51,2 a 53,4, dependendo do esforço de raciocínio. Esse valor não deve ser confundido automaticamente com o preço de saída da API no OpenRouter.

A divergência importa porque “custo equivalente ao Fable” pode significar coisas diferentes. Pode ser uma comparação de preço por token, uma estimativa de custo por tarefa ou um cálculo que inclui a quantidade de tokens gerada pelo agente. Cada método produz uma fatura diferente. Sem a definição usada no anúncio, a redução prometida não pode ser reproduzida.

Há alternativas com preço verificável

Enquanto o SWE 2 não tem preço conferível, o catálogo mostra opções mais baratas para quem precisa controlar o gasto. O DeepSeek V4.1 Flash custa US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída no OpenRouter, com contexto de 1.048.576 tokens. O Seed-2.0-Mini aparece a US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída, com contexto de 262.144 tokens.

Esses números não provam que qualquer um dos dois substitui o SWE 2 ou o Fable em tarefas complexas. Eles apenas permitem montar uma estimativa antes de liberar tráfego para produção. A escolha depende da taxa de acerto, do número de tentativas, do tamanho das respostas e da necessidade de raciocínio prolongado — informações que não estão disponíveis para o SWE 2 nesta comparação.

Para quem a notícia vale

Se você avalia agentes de programação por demonstrações e testes controlados, o lançamento pode justificar uma rodada de experimentos. O foco em engenharia de software é relevante para equipes que precisam delegar correções, refatorações e execução de tarefas em repositórios.

Para quem precisa escolher um modelo hoje, porém, a notícia não altera a fatura. O SWE 2 não tem preço, contexto ou notas de benchmark verificáveis nos dados disponíveis. Já o Fable tem preço definido, mas é uma opção de alto custo de saída no OpenRouter. A alegação de redução só se torna uma vantagem comercial quando houver uma rota de API e uma métrica de custo por tarefa que possam ser testadas.

Até lá, trate o SWE 2 como candidato a benchmark, não como linha confirmada no orçamento. Para produção, compare tarefas idênticas, registre tokens de entrada e saída e só migre quando o valor por tarefa aparecer na sua própria fatura.

Em uma frase

O SWE 2 pode merecer um teste, mas ainda não há preço ou benchmark verificável para justificar uma mudança de modelo em produção.

Perguntas frequentes

O SWE 2 já tem preço de API confirmado?

Não nos dados consultados. O modelo da Cognition não aparece com preço de entrada, saída, contexto ou identificador no catálogo disponível.

O SWE 2 é realmente mais barato que o Claude Fable 5.1?

A redução anunciada não pode ser confirmada. No OpenRouter, o Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, enquanto não há preço verificável para o SWE 2.

Qual modelo barato pode servir como referência de custo?

O DeepSeek V4.1 Flash aparece no OpenRouter a US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. O preço é verificável, mas os dados não permitem afirmar que ele tenha desempenho equivalente ao SWE 2 ou ao Fable.

Fontes

Leia também