Together把开源模型接进Claude Code,号称省一半

Together AI 10 月 5 日推出 Together Link,让开发者在不换工具的前提下,把 Claude Code、Codex 这些编码智能体背后的模型换成托管在 Together 上的开源模型。公司给出的说法是,模型开销能降低一半以上,对比基准是同样的会话全部跑在 Claude Opus 5.5 上。

目前支持的客户端有五个:Claude Code、Claude Desktop、Codex(ChatGPT 应用和命令行版)、OpenCode 和 Pi。

怎么接、怎么切回去

安装是一条 shell 命令,装完后各个工具原有的设置和登录状态不动。Together 在公告里强调了这一点:

“Settings and logins stay as they were, there’s nothing new to learn, and going back to the native closed models takes one command.” (设置和登录保持原样,不用学新东西,想切回原生闭源模型也只要一条命令。)

计费走开发者已有的 Together API 密钥,按量付费或买额度包都行,不需要另签合同。每个会话结束后,工具会显示实际花了多少,以及同一会话如果跑在 Opus 5.5 上大概要多少钱。

路由一个会话只做一次

产品的核心是一个叫 Auto 的模式,由 Together AI Router 决定每个会话用哪个模型。它读取会话里的第一个任务,小修小补分给便宜快速的模型,难题分给前沿级模型。

路由每个会话只发生一次。Together 的解释是这样能让提示词缓存持续生效。编码智能体一次会话动辄几十轮,上下文大量重复,缓存命中率直接决定成本,中途换模型等于把缓存清零。

可选的模型分两组:

  • 前沿级:智谱 GLM 5.3、月之暗面 Kimi K3,用来接最难的编码任务;
  • 日常级:GLM 5.3 Flash、DeepSeek V4.1 Flash,处理日常改动。

如果用户同时填了 Anthropic 的密钥,路由器会在 Opus 5.5 和 GLM 5.3 之间分配;没有 Anthropic 密钥,就在 GLM 5.3 和 GLM 5.3 Flash 之间选。

公告没有给出各模型在编码基准上的分数,也没有公开”省一半以上”是按哪类任务组合测出来的。按会话显示的成本对比是事后统计,真实降幅要看团队自己的任务构成。

四个模型全是中国团队的

对国内读者,这份名单有一层额外的意思:Together Link 主推的四个开源模型,全部出自中国团队,分别来自智谱、月之暗面和 DeepSeek。一家美国推理云公司拿国产开源模型,去替换美国编码智能体背后的 Anthropic 模型,卖点是便宜。

Together 在公告里引用了 OpenRouter 截至 9 月 30 日的数据:在 OpenRouter 上,DeepSeek V4.1 Flash 有 40.8% 的 token 由 Together 提供服务,GLM 5.3 Flash 是 28.2%,Kimi K3 是 23.1%。这组数字说明海外开发者对国产开源模型的实际调用已经不小。

对国内开发者,直接用处有限。Claude Code 在国内本来就有访问门槛,智谱、月之暗面、DeepSeek 自家也都提供与 Claude Code 兼容的接口和编程套餐,直接接官方 API 往往更便宜。Together Link 面向的主要是海外团队里那些已经被 Opus 账单压得喘不过气、又不想改工作流的工程部门。公告提到,这类团队的编码智能体花费每月从几万美元到上百万美元不等。

Anthropic 和 OpenAI 对第三方把自家客户端接到别家模型上的做法,目前没有公开表态。

参考来源:Together AI 官方博客、CocoLoop、OpenRouter 平台数据;token 份额以 Together 引用的 OpenRouter 统计为准,“省一半以上”为公司口径。