美团 LongCat-2.5 预览版上线,主攻长程任务

美团 LongCat 团队 9 月 25 日在自家 API 开放平台上线了 LongCat-2.5-Preview。这是 6 月底开源的 LongCat-2.0 之后的新一代模型,官方给它的定位是两个词:长程任务和多模态。

一天后,海外开源编程工具 OpenCode 宣布把它列为免费模型,开放两周,并标注零数据留存。

参数没变,加了眼睛

LongCat-2.5-Preview 延续混合专家(MoE)路线,总参数约 1.6 万亿,每次推理激活约 480 亿,和 2.0 版的规模在同一档。原生支持 100 万 token 上下文,单次最大输出 128K token。

变化集中在两处。一是新增图片理解,可以解析图像内容,做跨模态问答、内容摘要和视觉推理。二是面向”长流程”任务,美团列出的场景包括终端、浏览器、桌面软件、电子表格和设计工具,也就是让模型在一个任务里连续操作多个界面。

编程能力是这次宣传的重点。美团称它在代码生成、代码理解和自动化编程任务上表现突出,并且适配 Claude Code、OpenCode、OpenClaw、Hermes、Kilo Code 等主流编程工具。接口同时兼容 OpenAI 和 Anthropic 两种格式。

目前美团没有公布任何基准测试分数,GUI 操作和长流程任务上比 2.0 版进步了多少,外界暂时没有可对照的数据。这一版叫 Preview,官方也没说会不会像 2.0 那样开源权重。

对国内开发者意味着什么

最直接的一点是接入成本低。接口兼容 Anthropic 格式,意味着习惯用 Claude Code 的开发者,改一个 API 地址和密钥就能把后端模型换成 LongCat,工作流不用重写。对在国内调用海外模型不方便的团队来说,这等于多了一个现成的备选后端。

价格方面,美团给已有用户发了 500 万 token 免费额度。正式计费标准还没公布,Preview 阶段的价格和转正后的价格是否一致,也要等官方说明。

长上下文加长流程的组合,对应的是代码库级别的活。100 万 token 大致能装下一个中型项目的主要源码,让模型一次读完再动手改,比分段喂省去不少上下文拼接的麻烦。多步操作能坚持多少步不跑偏,要等开发者实际跑过才知道。

从 Owl Alpha 到 2.5

LongCat 走过的路线有迹可循。2.0 版开源前,曾以代号 Owl Alpha 在 OpenRouter 上匿名免费开放,调用量一度冲到平台第一,揭晓身份后才以 MIT 协议开源,美团称其训练和推理都跑在国产芯片集群上。

2.5-Preview 又一次选择先免费、再说价格:自家平台发试用额度,海外工具开放两周免费期。OpenCode 上两周的真实调用量和开发者反馈,大概率会影响正式版的定价。

参考来源:美团 LongCat API 开放平台、IT之家、OpenCode 官方账号、CocoLoop;核验 1.6 万亿总参数、约 480 亿激活参数、100 万 token 上下文、128K 最大输出与 500 万 token 试用额度。