AI导航

Together Link 上线:一条命令,编码智能体改用开源模型省一半账单

AI资讯
2 min read
0 次阅读

Together AI 在 2026 年 10 月 5 日通过官方博客推出 Together Link,解决的是工程团队一个很具体的浪费:不管是一行修复还是整仓重写,编码智能体默认都跑在最贵的闭源模型上。Together Link 的办法是不换工具,把模型换掉,一条安装命令之后,原来的智能体就改连 Together AI 上的开源模型。

支持的工具不少,回退也是一条命令

目前支持的智能体外壳包括 Claude Code、Claude Desktop、ChatGPT 应用和命令行里的 Codex、OpenCode 以及 Pi。团队的设置和登录状态保持原样,不用学新界面,想切回原生闭源模型也是一条命令的事。计费走团队自己已有的 Together API 密钥,按无服务器按量付费或额度包结算,不需要另签合同。安装完成后,每个会话都有一个对照账本,显示这次实际花了多少、同样的工作跑在 Opus 5.5 上本该花多少。

Auto 路由按会话分活,便宜模型干小活

Together Link 的自动路由会读每个会话的第一个任务来定模型:小修小补交给快而便宜的模型,难题才上前沿能力。有 Anthropic 密钥时,它在 Opus 5.5 和 GLM 5.3 之间分流;没有时,在 GLM 5.3 和 GLM 5.3 Flash 之间分流。路由只在会话开始时做一次,这样提示缓存不会被中途换模型打断。它可用的开源模型包括 Kimi K3、GLM 5.3 和 DeepSeek V4.1 Flash 等,官方还援引数据称,截至 2026 年 9 月 30 日,它在 OpenRouter 上承接了这几款模型相当大比例的 token 量。

降费超 50% 是厂商口径,前提是任务结构

官方说支出能降一半以上,这笔账成立的前提,是团队的任务里确实有大量本不需要前沿模型的日常活,而且路由分对了:难题被误分给便宜模型,返工成本会把省下的钱吃回去。另一点要留意,路由只看会话的第一个任务,一个会话中途从小改变成大重构时,模型不会自动升级。适合先试的是用量大、任务分层明显的团队:先在非关键仓库跑几周,用会话账本核对真实降幅和任务完成率,再决定是否全量切换。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。