OpenRouter lança Fusion e deixa o preço em branco no catálogo
A nova função não é um modelo — é uma camada que dispara vários em paralelo. A fatura, porém, continua imprevisível.
A OpenRouter colocou no ar hoje o Fusion — e a primeira coisa que salta aos olhos não é o que o produto faz, mas o que está faltando na ficha. Preço de entrada e preço de saída em branco no catálogo. Sem tabela publicada, você não tem como prever a fatura antes de rodar.
Isso porque Fusion não é um modelo novo. É outra coisa.
O que é, de fato
Fusion pega o seu prompt e dispara, em paralelo, para um painel de modelos diferentes — todos com busca na web habilitada. Depois, um modelo consolida as respostas em uma única saída. É o equivalente a pedir três opiniões médicas antes de decidir um tratamento — só que cada "especialista" é um modelo diferente.
A diferença em relação ao que você fazia à mão é a embalagem: agora vem num único endpoint, sem você precisar orquestrar nada.
O preço que não está lá
O catálogo lista Fusion sem tarifa de entrada nem de saída. O motivo é simples: o custo é variável. Depende de quais modelos o painel aciona, quantos rodam em paralelo e quanto cada um devolve. Comparar com Claude Fable 5 (US$ 50 por milhão de tokens de saída) ou com Gemini 3.5 Flash (US$ 9) é comparar laranjas com uma caixa fechada.
Mesmo o modelo mais barato acima de IQ 45 hoje — o MiniMax M3, a US$ 1,20 por milhão de tokens de saída — não serve de referência direta. Fusion multiplica chamadas, não troca uma por outra.
Onde isso se encaixa
A OpenRouter sempre foi uma camada de revenda/roteamento — ela lista modelos de terceiros, não treina os seus. Hoje ela própria vira um produto. Em vez de te ajudar a escolher um modelo, ela escolhe por você, em tempo real, e embute o custo de escolher.
Para quem está em cima do muro entre Claude Fable 5 (IQ 62,073, US$ 50 por milhão de tokens de saída) e Gemini 3.1 Pro Preview (IQ 47,738, US$ 12 por milhão), Fusion oferece um "por que não os dois?". Para quem já sabe qual modelo serve, é ruído.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Fusion (o novo) | — | -1000000 | -1000000 | 1M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| Gemini 3.5 Flash | 46.7 | 1.5 | 9 | 1.05M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
Para quem vale
Pesquisa exploratória com risco alto de alucinação. Decisões jurídicas, financeiras ou médicas em que você quer três opiniões antes de seguir. Perguntas que exigem checagem pesada, em que a busca rodando em paralelo com o raciocínio do modelo reduz a chance de erro. Nesses casos, pagar por quatro chamadas e uma síntese pode compensar — desde que o ganho de qualidade seja mensurável.
Para quem não muda nada
Tarefas em lote. Classificação. Sumarização de documento único. Qualquer coisa que já roda bem num modelo único de US$ 1,20 a US$ 9 por milhão de tokens de saída. Pipeline com RAG. Bots de atendimento. Tradução. Geração de código em escopo fechado.
Se você já tem um modelo bom o suficiente, Fusion não melhora — só encarece.
| Campo | Valor |
|---|---|
| Identificador | openrouter/fusion |
| Criador | openrouter |
| Preço de entrada | US$ -1000000.000 / M tokens |
| Preço de saída | US$ -1000000.000 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text->text |
O que você faz com isso
Se for testar, comece com prompts caros em que o erro custa caro. Conte os tokens manualmente no fim. Compare o resultado com a mesma pergunta num modelo único de elite. Se a diferença for marginal, volte. Se for consistente, meça em quantas chamadas o Fusion decide rodar por requisição — porque é ali que mora a conta.
E antes de colocar em produção, espere a OpenRouter publicar uma estimativa de custo por requisição. Sem isso, Fusion é uma caixa-preta na sua fatura.
Só teste Fusion com prompts em que o erro custa caro e meça o custo por requisição — sem preço publicado, a fatura dói onde você não esperava.
Perguntas frequentes
O que é o OpenRouter Fusion?
Não é um modelo novo, é uma camada de orquestração. Ela dispara seu prompt para vários modelos em paralelo, todos com busca na web habilitada, e depois consolida as respostas em uma única saída. Você paga por várias chamadas de modelo em cada requisição.
Quanto custa usar o Fusion?
O catálogo da OpenRouter não publicou uma tarifa fixa — nem de entrada nem de saída. O custo final depende de quais modelos o painel aciona e quantos tokens cada um consome, então só dá para saber depois de rodar.
Fusion vale a pena em produção?
Depende do tipo de tarefa. Para decisões de risco alto — jurídicas, financeiras, médicas — em que três opiniões reduzem erro, pode compensar. Para classificação, sumarização ou código em escopo fechado, um modelo único de US$ 1,20 a US$ 9 por milhão de tokens já resolve e custa menos.