2026年9月29日,OpenAI 在 DevDay 2026 开发者大会上发布了 GPT-6.1 Sol——GPT-6 Sol 的升级版本,主打智能体编码与 computer use,能力接近旗舰模型 GPT-6 Astra,标准输入输出 token 价格却只有 Astra 的五分之一。这款模型面向复杂重构、深度代码库调查和跨应用长时间运行的智能体任务,发布即日起可通过 API(模型名 gpt-6.1-sol)、ChatGPT Work 与 Codex 使用,覆盖 Plus、Pro、Business、Enterprise 和 Edu 用户;普通 ChatGPT 对话暂时还接不进来。
三项关键升级
先看智能体编码。OpenAI 公布的 DeepSWE v1.1 成绩里,GPT-6.1 Sol 在高推理档拿到 75.2%,而 GPT-6 Sol 的最好成绩是 68.8%,单任务成本还低了约 76%。再看 computer use:AutomationBench 中等推理档 31.7%,比 GPT-6 Sol 高出 4.8 个百分点;OSWorld 2.0 离线集上 Sol 拿到 71.4%,距离 Astra 的 73.5% 只差 2.1 个百分点,单任务成本却只有 Astra 的七分之一左右。最后是事实性:低推理档的刻意刁难测试中,包含事实错误的回答从 11.4% 降到 7.7%,降幅约 32%,各推理档的错误率与 Astra 相差不超过 1.9 个百分点。自动安全评审里没有发现模型试图绕过安全检查的行为。
便宜到底便宜在哪
定价是这次发布最实在的部分:标准输入 2 美元/百万 token,输出 10 美元/百万 token,缓存输入只要 0.10 美元/百万 token——相当于标准输入价打了 95 折还多的折扣。对照 Astra 的 10 美元/50 美元输入输出定价,正好是五分之一。智能体任务一次执行要调几十甚至上百次模型,单价差会直接决定一条自动化工作流跑下来是几美元还是几十美元。对预算敏感的大规模智能体部署来说,这个价差比榜单分数更实在。OpenAI 还预告了 Sol 的 Ultrafast 版本,未来几天内上线 Codex,token 生成速度最高可达 8 倍,当然价格也会更高。
这笔账对谁划算
如果你在做需要长时间自主运行的编码智能体、跨应用操作(computer use)、或者要把智能体工作流铺到生产环境,Sol 是目前 OpenAI 体系里性价比最高的选择:能力贴着 Astra,账单只有零头。但它不是万能药:普通 ChatGPT 对话里暂时用不到它;对智能上限有极致要求的任务,Astra 仍然是旗舰。值得一提的背景是,就在发布前一天,OpenAI 刚因为安全测试不达标取消了 GPT-6.1 Astra 的发布计划——Sol 的定位,恰好是“够用、合规、便宜”的那一档。
下一步值得关注的是 Ultrafast 版本的实际延迟表现,以及 Sol 在真实生产工作流里的长期稳定性。更多 OpenAI 动态可以在 OpenAI 专题 继续跟踪。