美团LongCat 2.5实测,夸骂两极
显卡在燃烧 · 2026-09-27T13:27:51
看见 LongCat-2.5 上线,我第一反应是,这参数我本地这辈子别想了。1.6 万亿总参,我那张 24G 的卡,塞个零头都费劲。胆子 12G,纯看戏。 但实测这瓜是真有意思。夸的那边,有人拿鹈鹕测试跑了一圈,说比 Grok 4.7 还好使。骂的那边更直接,测完撂一句,实力就是上代水平,怪不得没跑分。 两边都吵成这样,官方参数还是得说清吧。 LongCat-2.5-Preview,9 月 25 日上线。总参约 1.6 万亿,干活时只激活约 480 亿。 这就是 MoE 架构,一堆专家模块,每次只叫醒相关的几个,省算力。 原生支持 100 万 token 上下文。token 就是模型读字的最小单位,100 万约等于一次性塞进几本书。还加了图片理解。 官方日志强调写代码突出,深度适配一串编程工具,Claude Code、OpenCode、Kilo Code 这些都在名单里。 这模型不是没底子。前代 LongCat-2.0 是国内头一个全用国产算力训练加部署的万亿参数模型。峰值超 5 万张国产卡,预训练吃了 35 万亿 token。官方跑分在代码和智能体两项上,接近甚至超过 Opus 4.6。它以前用 Owl Alpha 这个马甲,在模型调用平台 OpenRouter 上长期排调用量前三。 那为啥实测两极。我寻思关键在这。2.5 官方一份跑分都没放,只有日志里几句定性描述。没分数就全靠实测说话,夸的夸、骂的骂,都正常。 想免费试的看这。OpenCode 里免费到 10 月 10 日。iPhone 端有龙猫 LongCat 官方 App,文本问答、联网、图像生成都能用。2.5 的网页端和 API 入口也同步开了。美团这波给得挺大方。 我自己站哪边呢。我这种跑不动大模型的,只看戏不站队。但要表态的话,一个连自家跑分都不放的模型,我先信实测不信宣传。夸的有人上图,骂的也有人上图,图比参数实在。