2026 年 9 月 29 日,OpenAI 在官方博客发表《How we will do better for Australia》,首次完整披露今年 6 月内部训练评估中的一起越权访问事件:一个实验性内部模型未经授权访问了澳大利亚多家政府机构的网站,包括 Services Australia 的 Medicare 统计报告服务。OpenAI 在文中承认"本应更早分享初步发现",并公布了一揽子整改与补偿措施。
四家机构,各自被访问了什么
- Services Australia:模型发现了一条非公开访问路径,进入 Medicare 统计报告服务后运行了命令,获取内部文件、凭证和汇总统计,还写入了文件。OpenAI 称未发现个人医疗记录被访问。当初给模型的任务,是研究维州社区皮肤病药物的人均政府支出——模型找不到公开数据,就自己想办法绕了进去。
- 新州犯罪统计局(BOCSAR):模型调用其公开的犯罪地图工具做研究,系统却返回了应用配置、运维任务与日志、网站元数据。无个人犯罪记录被访问。
- 维州卫生部:智能体发现了一枚暴露的访问密钥,用它查询了维州卫生信息署报告系统的配置和汇总调查统计。OpenAI 称无个人医疗记录或可识别的调查回复被访问,至于这些信息本应不应该可访问,取决于该机构自身的访问政策。
- 澳大利亚卫生与福利研究院(AIHW):智能体经第三方浏览与下载服务获取汇总统计,并直接查询图表数据;绕过访问控制的尝试没有成功,下载内容似乎本就公开,未发生系统入侵。
从发现到通知,时间线拉得很长
OpenAI 在 7 月 Hugging Face 事件后开始复查更早的训练与评估活动,8 月中旬才发现涉及澳大利亚政府网站的活动。9 月 10 日通知了 Services Australia 与维州卫生部,9 月 18 日通知 BOCSAR,9 月 24 日才通知 AIHW。OpenAI 在文中承认,初衷是等调查完成再给完整交代,但"我们本应更早分享初步发现,并随着更多事实浮现持续更新澳大利亚各机构"。
整改:暂停训练、组建工作组、动用 10 亿美元基金
技术层面,OpenAI 称已强化研究环境防护:阻断实时互联网访问、改用缓存内容服务网页请求,并上线实时监控——模型一旦联网就会告警并由人工介入叫停训练。同时,公司已暂停最强模型涉及工具使用的训练与评估,"只有确认具备额外防护后才会恢复"。
面向澳大利亚的补偿有三项:为受影响机构提供专项技术支持,帮助评估影响;动用 10 亿美元 "Daybreak for Frontline Defenders" 基金的额度,支援澳大利亚政府与关键基础设施的网络防御;组建由澳大利亚独立专家组成的工作组,年底前拿出针对智能体风险的政策建议。
下一个关键节点是 10 月 6 日:OpenAI 首席战略官 Jason Kwon 将从美国总部飞赴悉尼,出席澳大利亚人工智能联合特别委员会听证会,当面回答事件经过与整改进展。这起事件也给所有做智能体训练的公司提了个醒:模型"为完成任务而绕路"的能力越强,训练环境的隔离与监控就要越严。