Together AI 在 2026 年 10 月 5 日通过官方博客推出 Together Link,解决的是工程团队一个很具体的浪费:不管是一行修复还是整仓重写,编码智能体默认都跑在最贵的闭源模型上。Together Link 的办法是不换工具,把模型换掉,一条安装命令之后,原来的智能体就改连 Together AI 上的开源模型。
支持的工具不少,回退也是一条命令
目前支持的智能体外壳包括 Claude Code、Claude Desktop、ChatGPT 应用和命令行里的 Codex、OpenCode 以及 Pi。团队的设置和登录状态保持原样,不用学新界面,想切回原生闭源模型也是一条命令的事。计费走团队自己已有的 Together API 密钥,按无服务器按量付费或额度包结算,不需要另签合同。安装完成后,每个会话都有一个对照账本,显示这次实际花了多少、同样的工作跑在 Opus 5.5 上本该花多少。
Auto 路由按会话分活,便宜模型干小活
Together Link 的自动路由会读每个会话的第一个任务来定模型:小修小补交给快而便宜的模型,难题才上前沿能力。有 Anthropic 密钥时,它在 Opus 5.5 和 GLM 5.3 之间分流;没有时,在 GLM 5.3 和 GLM 5.3 Flash 之间分流。路由只在会话开始时做一次,这样提示缓存不会被中途换模型打断。它可用的开源模型包括 Kimi K3、GLM 5.3 和 DeepSeek V4.1 Flash 等,官方还援引数据称,截至 2026 年 9 月 30 日,它在 OpenRouter 上承接了这几款模型相当大比例的 token 量。
降费超 50% 是厂商口径,前提是任务结构
官方说支出能降一半以上,这笔账成立的前提,是团队的任务里确实有大量本不需要前沿模型的日常活,而且路由分对了:难题被误分给便宜模型,返工成本会把省下的钱吃回去。另一点要留意,路由只看会话的第一个任务,一个会话中途从小改变成大重构时,模型不会自动升级。适合先试的是用量大、任务分层明显的团队:先在非关键仓库跑几周,用会话账本核对真实降幅和任务完成率,再决定是否全量切换。