Together AI於10月5日推出Together Link,讓開發者在不換工具的前提下,把Claude Code、Codex這類程式碼代理背後的模型,換成架設在Together上的開源模型。該公司的說法是,模型費用能降低五成以上,比較基準是同一個工作階段全部跑在Claude Opus 5.5上。
目前支援的用戶端有五個:Claude Code、Claude Desktop、Codex(ChatGPT應用程式版與命令列版)、OpenCode與Pi。
怎麼接上去、怎麼切回來
安裝只要一道shell指令,裝完後各工具原有的設定與登入狀態都不會動。Together在公告裡特別強調了這一點:
"Settings and logins stay as they were, there's nothing new to learn, and going back to the native closed models takes one command."
(設定與登入都維持原樣,不用學新東西,想切回原生封閉模型也只要一道指令。)
計費走開發者已有的Together API金鑰,按用量付費或買額度包都行,不需要另簽合約。每個工作階段結束後,工具會顯示實際花了多少錢,以及同一個工作階段若跑在Opus 5.5上大概要多少錢。
路由每個工作階段只做一次
這個產品的核心是一個叫Auto的模式,由Together AI Router決定每個工作階段要用哪個模型。它讀取工作階段裡的第一個任務,小修小補分給便宜又快速的模型,難題分給前沿級模型。
路由每個工作階段只發生一次。Together的解釋是,這樣才能讓提示詞快取持續有效。程式碼代理一個工作階段動輒跑上幾十輪,脈絡內容大量重複,快取命中率直接決定成本,中途換模型等於把快取清空。
可選的模型分成兩組:
- 前沿級:智譜的GLM 5.3、月之暗面的Kimi K3,用來處理最難的程式碼任務;
- 日常級:GLM 5.3 Flash、DeepSeek V4.1 Flash,處理日常的修改工作。
如果使用者同時填了Anthropic的金鑰,路由器會在Opus 5.5與GLM 5.3之間分配;沒有Anthropic金鑰,就在GLM 5.3與GLM 5.3 Flash之間選擇。
公告並未公開各模型在程式碼基準測試上的分數,也沒說明「省五成以上」是用哪種任務組合測出來的。工作階段顯示的成本對比是事後統計,實際降幅要看各團隊自己的任務組成。
四個模型全出自中國團隊
對中文讀者來說,這份名單多了一層意義:Together Link主推的四個開源模型,全部出自中國團隊——分別來自智譜、月之暗面與DeepSeek。一家美國推理雲端公司,拿中國開源模型去取代美國程式碼代理背後的Anthropic模型,賣點是便宜。
Together在公告裡引用了OpenRouter截至9月30日的數據:在OpenRouter平台上,DeepSeek V4.1 Flash有40.8%的token由Together提供服務,GLM 5.3 Flash是28.2%,Kimi K3是23.1%。這組數字說明海外開發者對中國開源模型的實際使用量已經不小。
對中國開發者來說,直接用處有限。Claude Code在中國本來就有存取門檻,智譜、月之暗面、DeepSeek自家也都提供與Claude Code相容的介面與程式碼方案,直接接官方API往往更便宜。Together Link主要瞄準的是海外團隊裡那些已經被Opus帳單壓得喘不過氣、卻又不想改工作流程的工程部門。公告提到,這類團隊的程式碼代理花費每月從數萬美元到上百萬美元都有。
Anthropic與OpenAI對於第三方把自家用戶端接到別家模型上的做法,目前都還沒有公開表態。
參考來源:Together AI官方部落格、CocoLoop、OpenRouter平台數據;token佔比以Together引用的OpenRouter統計為準,「省五成以上」為該公司自己的說法。