Aion-2.0 entra a US$ 1,60 por milhão de tokens sem benchmark de inteligência
Variante do DeepSeek V3.2 para roleplay é 87% mais barata que o Gemini 3.1 Pro Preview, mas sem nota de IQ não dá para colocar no gráfico de custo-benefício.
A US$ 1,60 por milhão, o Aion-2.0 entra sem nota de IQ
A AionLabs colocou no catálogo hoje o Aion-2.0, descrito como uma variante do DeepSeek V3.2 ajustada para roleplay imersivo e narrativa longa. O preço de saída: US$ 1,60 por milhão de tokens. Isso é 87% mais barato que o Gemini 3.1 Pro Preview (US$ 12/M), o topo de inteligência do momento, e quase 10 vezes mais barato que o Claude Sonnet 4.6 (US$ 15/M).
À primeira vista, parece uma pechincha. Mas tem um porém grande que muda quem pode, de fato, considerar esse modelo.
O que o release não diz
O Aion-2.0 entra no catálogo sem nota de inteligência, sem benchmark de código, sem índice agentic. Nenhum número que permita comparar com quem já está lá. Para um modelo genérico isso seria estranho; para um modelo de nicho — roleplay, storytelling, introdução de tensão narrativa — pode ser proposital. A AionLabs não está brigando pelo topo do gráfico de IQ. Está vendendo um ajuste fino para quem escreve ficção interativa, diálogo de NPC, chat de personagem.
| Campo | Valor |
|---|---|
| Identificador | aion-labs/aion-2.0 |
| Criador | aion-labs |
| Preço de entrada | US$ 0.800 / M tokens |
| Preço de saída | US$ 1.60 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.200 / M (75% de desconto) |
Mas "não ter benchmark" tem um custo prático: você não consegue colocar o Aion-2.0 num gráfico de custo-benefício e decidir no olhômetro. Precisa testar, e testar custa tempo de engenharia.
Onde ele se encaixa no tabuleiro de hoje
O cenário é este: 341 modelos listados, 52 criadores, 19 lançamentos nos últimos 30 dias. O topo de inteligência segue com o Gemini 3.1 Pro Preview em 47,7 de IQ, seguido de Claude Sonnet 4.6 (35,1) e Qwen 3.5 397B (34,2). O Aion-2.0 não pontua em nenhum desses índices — e não dá para cravar se isso é porque é fraco, porque é nicho, ou porque a AionLabs simplesmente não submeteu.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Aion-2.0 (o novo) | — | 0.8 | 1.6 | 131k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| Claude Sonnet 4.6 | 35.1 | 3 | 15 | 1M |
| Qwen3.5 397B A17B | 34.3 | 0.55 | 3.5 | 262k |
Em preço de saída, ele só perde para o Xiaomi MiMo-V2-Flash (US$ 0,30/M) e para o Qwen 3.5 397B (US$ 2,34/M). Está mais barato que qualquer modelo de laboratório grande no recorte de "topo de inteligência" do catálogo. A conta é simples: se o modelo entregar metade do que o release promete no seu caso de uso, o custo por sessão de roleplay cai para uma fração do que está no ar hoje.
Para quem vale a pena olhar
Se você roda um app de roleplay, um estúdio de jogo com diálogo procedural, ou uma plataforma de ficção interativa — o preço de US$ 1,60/M com cache a US$ 0,20/M é uma proposta que vale um piloto. A janela de contexto de 131 mil tokens aguenta cenas longas sem precisar resumir a cada turno, o que importa quando o usuário está no meio de um arco narrativo de vinte mensagens.
Se você está montando pipeline de código, agente autônomo, ou qualquer coisa que dependa de raciocínio verificável — não tem como avaliar sem benchmark. E sem benchmark, a conta de "barato" não fecha quando um erro de lógica custa caro. Para esses casos, o catálogo tem opções com nota publicada e preço maior, mas com lastro.
O que fazer com essa informação
Espere um benchmark independente antes de colocar em produção séria. Para protótipo de narrativa, o preço convida a testar — e a diferença entre US$ 12 e US$ 1,60 por milhão de tokens de saída aparece rápido na fatura quando você tem volume. Roleplay é exatamente o tipo de uso que vira volume sem você perceber: cada sessão é uma sequência de turnos, e cada turno é uma chamada. Para decidir, rode um conjunto de 50 a 100 prompts do seu caso de uso real, meça qualidade com os mesmos critérios que você já usa nos modelos atuais, e só então compare o custo por sessão aceitável.
Para roleplay e narrativa, vale testar como piloto pelo preço; para código, agentes ou qualquer tarefa com raciocínio verificável, a ausência de benchmark impede qualquer decisão séria.
Perguntas frequentes
Aion-2.0 serve para coding ou agentes autônomos?
Não tem benchmark publicado de código nem índice agentic. Para pipelines que dependem de raciocínio verificável, o catálogo tem opções com nota e preço maior, mas com lastro comparativo — e esse lastro importa quando um erro custa caro.
Quanto o Aion-2.0 custa em relação ao Gemini 3.1 Pro?
US$ 1,60 contra US$ 12 por milhão de tokens de saída — 87% mais barato. Em uso de volume, a diferença aparece rápido na fatura, especialmente em sessões longas de roleplay com muitos turnos.
Por que o Aion-2.0 não tem nota de IQ?
O catálogo lista o IQ como nulo. Pode ser nicho, pode ser opção da AionLabs de não submeter, pode ser cedo demais. Sem benchmark independente, não dá para cravar — e essa é a principal limitação para quem precisa comparar antes de adotar.