2026 年 9 月 24 日,The Information 援引知情人士报道,Google、OpenAI 与 Anthropic 正在筹建一个新的 AI 安全标准组织,目标是在今年年底或明年年初正式成立。这是三家前沿模型实验室第一次尝试以纯行业自律的形式,统一安全标准与事件披露规则——不再等政府先动手。
这个组织打算做什么
根据报道,新组织有四个明确方向:支持第三方机构在模型部署前做独立测试;明确 AI 开发者应如何上报安全与安保事件;界定各实验室自愿遵守的安全承诺;为独立审计机构设定资质门槛。工作组还在讨论,是否让组织本身也直接参与模型的能力与安全测试。
值得注意的是,三家公司最初想做的是公私合营的合作模式,但这一努力在特朗普政府任内陷入停滞,才转向纯行业自律路线。这意味着新组织的约束力完全来自成员的自愿承诺,没有政府背书,成败取决于头部实验室愿不愿意把自己交出去被查。
这也不是三家第一次抱团:2023 年,Anthropic、Google、OpenAI 与微软共同成立了非营利组织前沿模型论坛(Frontier Model Forum),目标与新组织高度重合。报道称该论坛目前仍在运转,新组织与其保持着联系,未来可能合作或分工——相当于在已有框架上再加一层更聚焦的执行机构。
批评:标准会不会变成护城河
批评声已经先到了。报道引述批评者观点:由三家最大的闭源实验室主导标准制定,可能被用来排挤开源模型开发者和其他竞争者——标准本身可能成为护城河,谁来定义"安全",谁就掌握了准入的话语权。
同一周的另一件事让这条消息更有分量。彭博社 9 月 24 日报道,Anthropic 首席执行官 Dario Amodei 与 OpenAI 首席执行官 Sam Altman 在联合国安理会关于 AI 的会议上同场发言,一致认同需要全球标准来应对潜在风险;微软总裁 Brad Smith 则在接受彭博电视采访时表示,微软支持独立评估机构,并主张为先进系统保留人类可关闭的开关。
对开发者和普通读者来说,这个组织如果成立,最直接的影响可能在两处:一是第三方测评机构的地位会被抬高,未来模型的"安全成绩单"可能有统一口径;二是安全事件的披露规则可能统一——类似今年夏天几起智能体越界事件"报与不报、报多少"的争议,会有行业级参照。下一步值得看的是,年底前这个组织能否真的挂牌,以及开源阵营会不会被纳入谈判桌。