LongCat 2.0 da Meituan chega a US$ 1,20 por milhão de saída e abre os pesos
Modelo sparse MoE de 1,6T parâmetros com apenas 48B ativos foca em coding e tarefas agentic; rivaliza em preço com o MiniMax M3 mas fica longe do topo em inteligência.
O gancho é o preço, não o IQ
A Meituan — dona do iFood chinês, só para situar — colocou hoje no catálogo um modelo com 1,6 trilhão de parâmetros totais e cobrando US$ 1,20 por milhão de tokens de saída. É o mesmo preço de saída do MiniMax M3 e do GPT-5.6 Luna, e quase metade do DeepSeek V4 Pro. Só que o LongCat 2.0 não joga na mesma liga de inteligência: marca 33,97 no índice da Artificial Analysis, contra 45,40 do M3 e 52,32 do Luna. Em outras palavras, você paga o mesmo e leva menos IQ.
O que esse modelo é, na prática
LongCat 2.0 é um sparse mixture-of-experts: dos 1,6T de parâmetros, só 48B são ativados por token. Pense num restaurante com 1.600 chefs no quadro, mas só 48 vão pra cozinha a cada pedido — você paga pelo time todo na folha, mas só consome a fração que trabalha. O resultado é um modelo com peso aberto (open weights), raciocínio habilitado, focado em coding, mudanças em nível de repositório e tarefas agentic de longa duração. O índice de coding dele é 45,26, o agentic 21,96 — números que você não vê em comunicado de imprensa.
| Campo | Valor |
|---|---|
| Identificador | meituan/longcat-2.0 |
| Criador | meituan |
| Preço de entrada | US$ 0.300 / M tokens |
| Preço de saída | US$ 1.20 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.006 / M (98% de desconto) |
| Índice de inteligência (AA) | 34.0 |
| Índice de código | 45.3 |
| Índice agêntico | 22.0 |
| Parâmetros | 1600B (48B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 44 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Onde ele se encaixa no tabuleiro
O topo do catálogo hoje é da Anthropic, com Claude Fable 5 marcando 62,07 a US$ 50 por milhão de saída. OpenAI vem logo atrás com GPT-5.6 Sol (60,93 a US$ 10) e MoonshotAI com Kimi K3 (59,70 a US$ 15). LongCat 2.0 está 28 pontos abaixo do líder e cobra quase 42 vezes menos no output. É uma distância grande demais para chamar de "concorrente do topo".
Para quem olha custo-benefício, o cenário fica mais honesto: MiniMax M3 entrega 45,40 de IQ pelo mesmo US$ 1,20, e o GPT-5.6 Luna entrega 52,32 também a US$ 1,20. Nenhum dos dois exige que você hospede o modelo. LongCat 2.0 só vence se você quiser rodar localmente — aí o peso aberto compensa a diferença de capacidade.
Para quem vale, e para quem não muda nada
Vale para você se: roda inferência própria, precisa de peso aberto chinês por questão regulatória ou de supply chain, ou está montando um pipeline de coding agentic onde o índice 45 em coding já é suficiente. Não vale se você consome via API e quer o melhor IQ pelo menor preço — nesse caso, MiniMax M3 e GPT-5.6 Luna entregam mais pelo mesmo real. E não muda nada para quem já paga Claude Fable 5 ou GPT-5.6 Sol buscando capacidade máxima.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| LongCat 2.0 (o novo) | 34.0 | 0.3 | 1.2 | 1.05M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| GPT-5.6 Sol | 60.9 | 2 | 10 | 1.05M |
| Kimi K3 | 59.7 | 3 | 15 | 1.05M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| GPT-5.6 Luna | 52.3 | 0.2 | 1.2 | 1.05M |
O detalhe que ninguém comenta
O preço de cache do LongCat 2.0 está em US$ 0,006 por milhão — cinco vezes mais barato que o de entrada (US$ 0,30). Isso é um sinal claro de que a Meituan quer volume em workloads com prompt repetido, tipo agentes que re-leem o mesmo contexto a cada turno. Se o seu caso é esse, o custo efetivo cai bastante. O blended price anunciado é US$ 1,30 por milhão, basicamente alinhado com o de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
| Grok 4.5 | 55.8 | 6 |
Em julho de 2026, o catálogo já soma 510 modelos de 66 criadores, com 35 lançamentos nos últimos 30 dias. Mais um sparse MoE chinês entra na lista — o diferencial real não é a capacidade, é o peso aberto nesse patamar de preço.
Se você roda localmente e precisa de peso aberto chinês, vale testar; se consome via API, MiniMax M3 e GPT-5.6 Luna entregam mais IQ pelo mesmo preço.
Perguntas frequentes
Quanto custa o LongCat 2.0 da Meituan?
US$ 0,30 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída, com cache a US$ 0,006 por milhão. O preço blended fica em US$ 1,30 por milhão.
LongCat 2.0 é melhor que o MiniMax M3?
Não no índice de inteligência: LongCat marca 33,97 contra 45,40 do M3, cobrando o mesmo preço de saída (US$ 1,20 por milhão). O LongCat só leva vantagem se você quiser rodar o modelo localmente, já que tem peso aberto.
Quantos parâmetros o LongCat 2.0 ativa por inferência?
48 bilhões de parâmetros ativos sobre 1,6 trilhão totais — arquitetura sparse mixture-of-experts. É a fração pequena do total que efetivamente roda a cada token.