FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

LongCat 2.0 da Meituan chega a US$ 1,20 por milhão de saída e abre os pesos

Modelo sparse MoE de 1,6T parâmetros com apenas 48B ativos foca em coding e tarefas agentic; rivaliza em preço com o MiniMax M3 mas fica longe do topo em inteligência.

Redação FalaVIP IA 3 min de leitura
US$ 1,20por milhão de tokens de saída
48B / 1,6Tparâmetros ativos sobre total
33,97índice de inteligência (Artificial Analysis)

O gancho é o preço, não o IQ

A Meituan — dona do iFood chinês, só para situar — colocou hoje no catálogo um modelo com 1,6 trilhão de parâmetros totais e cobrando US$ 1,20 por milhão de tokens de saída. É o mesmo preço de saída do MiniMax M3 e do GPT-5.6 Luna, e quase metade do DeepSeek V4 Pro. Só que o LongCat 2.0 não joga na mesma liga de inteligência: marca 33,97 no índice da Artificial Analysis, contra 45,40 do M3 e 52,32 do Luna. Em outras palavras, você paga o mesmo e leva menos IQ.

Preço de saída (US$ por milhão de tokens)
LongCat 2.01,2Claude Fable 550GPT-5.6 Sol10Kimi K315MiniMax M31,2GPT-5.6 Luna1,2US$/M
Fonte: OpenRouter

O que esse modelo é, na prática

LongCat 2.0 é um sparse mixture-of-experts: dos 1,6T de parâmetros, só 48B são ativados por token. Pense num restaurante com 1.600 chefs no quadro, mas só 48 vão pra cozinha a cada pedido — você paga pelo time todo na folha, mas só consome a fração que trabalha. O resultado é um modelo com peso aberto (open weights), raciocínio habilitado, focado em coding, mudanças em nível de repositório e tarefas agentic de longa duração. O índice de coding dele é 45,26, o agentic 21,96 — números que você não vê em comunicado de imprensa.

Ficha técnica — LongCat 2.0
CampoValor
Identificadormeituan/longcat-2.0
Criadormeituan
Preço de entradaUS$ 0.300 / M tokens
Preço de saídaUS$ 1.20 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.006 / M (98% de desconto)
Índice de inteligência (AA)34.0
Índice de código45.3
Índice agêntico22.0
Parâmetros1600B (48B ativos por token)
Pesosabertos
Velocidade de saída44 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Onde ele se encaixa no tabuleiro

O topo do catálogo hoje é da Anthropic, com Claude Fable 5 marcando 62,07 a US$ 50 por milhão de saída. OpenAI vem logo atrás com GPT-5.6 Sol (60,93 a US$ 10) e MoonshotAI com Kimi K3 (59,70 a US$ 15). LongCat 2.0 está 28 pontos abaixo do líder e cobra quase 42 vezes menos no output. É uma distância grande demais para chamar de "concorrente do topo".

Índice de inteligência (Artificial Analysis)
LongCat 2.034Claude Fable 562,1GPT-5.6 Sol60,9Kimi K359,7MiniMax M345,4GPT-5.6 Luna52,3índice
Fonte: Artificial Analysis

Para quem olha custo-benefício, o cenário fica mais honesto: MiniMax M3 entrega 45,40 de IQ pelo mesmo US$ 1,20, e o GPT-5.6 Luna entrega 52,32 também a US$ 1,20. Nenhum dos dois exige que você hospede o modelo. LongCat 2.0 só vence se você quiser rodar localmente — aí o peso aberto compensa a diferença de capacidade.

Inteligência × preço de saída
LongCat 2.0Claude Fable 5GPT-5.6 SolKimi K3MiniMax M3GPT-5.6 LunaUS$ por milhão (saída, escala log)índice de inteligência

Para quem vale, e para quem não muda nada

Vale para você se: roda inferência própria, precisa de peso aberto chinês por questão regulatória ou de supply chain, ou está montando um pipeline de coding agentic onde o índice 45 em coding já é suficiente. Não vale se você consome via API e quer o melhor IQ pelo menor preço — nesse caso, MiniMax M3 e GPT-5.6 Luna entregam mais pelo mesmo real. E não muda nada para quem já paga Claude Fable 5 ou GPT-5.6 Sol buscando capacidade máxima.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
LongCat 2.0 (o novo)34.00.31.21.05M
Claude Fable 562.110501M
GPT-5.6 Sol60.92101.05M
Kimi K359.73151.05M
MiniMax M345.40.31.21.05M
GPT-5.6 Luna52.30.21.21.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O detalhe que ninguém comenta

O preço de cache do LongCat 2.0 está em US$ 0,006 por milhão — cinco vezes mais barato que o de entrada (US$ 0,30). Isso é um sinal claro de que a Meituan quer volume em workloads com prompt repetido, tipo agentes que re-leem o mesmo contexto a cada turno. Se o seu caso é esse, o custo efetivo cai bastante. O blended price anunciado é US$ 1,30 por milhão, basicamente alinhado com o de saída.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Grok 4.555.86
Entre os 510 modelos disponíveis no catálogo nesta data.

Em julho de 2026, o catálogo já soma 510 modelos de 66 criadores, com 35 lançamentos nos últimos 30 dias. Mais um sparse MoE chinês entra na lista — o diferencial real não é a capacidade, é o peso aberto nesse patamar de preço.

Em uma frase

Se você roda localmente e precisa de peso aberto chinês, vale testar; se consome via API, MiniMax M3 e GPT-5.6 Luna entregam mais IQ pelo mesmo preço.

Perguntas frequentes

Quanto custa o LongCat 2.0 da Meituan?

US$ 0,30 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída, com cache a US$ 0,006 por milhão. O preço blended fica em US$ 1,30 por milhão.

LongCat 2.0 é melhor que o MiniMax M3?

Não no índice de inteligência: LongCat marca 33,97 contra 45,40 do M3, cobrando o mesmo preço de saída (US$ 1,20 por milhão). O LongCat só leva vantagem se você quiser rodar o modelo localmente, já que tem peso aberto.

Quantos parâmetros o LongCat 2.0 ativa por inferência?

48 bilhões de parâmetros ativos sobre 1,6 trilhão totais — arquitetura sparse mixture-of-experts. É a fração pequena do total que efetivamente roda a cada token.

Leia também