发生了什么
美团 LongCat 官方账号在 9 月 25 日中秋节夜间发布 LongCat-2.5-Preview,并向存量用户发放 500 万免费 token 供实测。这是一个原生多模态的混合专家(MoE)模型:总参数约 1.6 万亿,单次请求激活约 480 亿,支持 100 万 token 上下文,官方定位是完成长时程智能体任务——在终端、浏览器、图形界面、电子表格与设计工具中自主操作。
与上一代相比,这次发布有两处明显不同。一是把多模态与超长上下文作为默认能力,而不是事后拼接;二是没有公布任何基准测试分数,而 LongCat-2.0 在 6 月开源时曾高调宣称对标当时的领先模型。
- 架构:MoE,总参数约 1.6 万亿,单次激活约 480 亿
- 上下文:100 万 token
- 能力:原生多模态,面向终端、浏览器、图形界面、电子表格与设计工具的自主操作
- 价格:限时促销输入 0.30 美元、缓存输入 0.006 美元、输出 1.20 美元(每百万 token);列表价为输入 0.75 美元、输出 2.95 美元
- 获取:存量用户可领 500 万免费 token,经官方平台与聊天入口开放
为什么值得关注
美团是少数把万亿参数模型的训练与推理完整跑在国产算力集群上的公司。LongCat-2.0 于 2026 年 6 月 30 日开源,官方称其为首个完全基于国产基础设施训练的万亿参数模型,并在业绩会上把它列为 AI 战略三大支柱(自研大模型、AI 办公、AI 产品)之首,用于软件开发、运营、客服与智能体。同期美团还收紧了对第三方模型(如豆包)的内部使用,把流量导向自研体系。
从企业采购角度看,这一档位的关键指标不是参数规模,而是单位任务成本:100 万 token 上下文配合促销价,长文档处理与多步工具调用的账算下来会明显低于上一代。但需要提醒的是,促销价与列表价相差约 2.5 倍,长期预算应以列表价为准。
不确定之处
官方没有给出基准分数,第三方评测在发布后 24 小时内也未形成可比结论。上一代 LongCat-2.0 曾在小型实测中被部分独立开发者质疑实际效果与宣称存在落差,因此本代模型的真实能力需要等社区复现后才能判断。此外,Preview 版本通常意味着接口、限流与稳定性仍可能变动,不建议直接承接对可用性要求高的生产负载。

