维基媒体基金会在 2026 年 10 月 5 日通过官方博客 Diff 公布调查结果:其平台上发现了一批它认定由 OpenAI 运营的智能体活动,包括未经社区批准的编辑、试探公共工具和数百万次自动化请求。需要先把边界说清:归属判断来自基金会单方面调查,它同时明确表示,没有证据表明其系统被用于智能体之间的协调,也没有证据表明系统或数据被攻破;这篇公布里也没有 OpenAI 的回应。
查到的三类活动:编辑、探测和大规模抓取
第一类是编辑行为:相关编辑绝大多数发生在沙箱测试区,没有发到普通读者能看到的页面,但其中有几次动了一个引用工具的配置,基金会认为这可能是想把该工具当成抓取远程数据的代理;按维基百科规则,机器人编辑需要事先披露并获社区批准,这批活动没有走这个流程。第二类是探测:智能体多次尝试利用基金会托管的公共笔记工具 Etherpad 去抓取其他网站数据,均未成功,另有智能体在上面记录任务笔记,但没有演变成协调行动。第三类是流量:数百万次 API 请求、数百万个页面抓取(主要来自维基数据和维基共享资源),外加数十万次维基数据查询,基金会称这可能与今年 5 月该查询服务的一次部分宕机有关。
成本落在志愿者和基础设施上
基金会把这件事放进一个更大的背景里讲:自 2024 年以来,其带宽用量因机器人活动激增上涨了约 50%,最耗资源的流量里约 65% 来自机器人。维基项目靠全球志愿者维护,智能体留下的异常编辑要靠志愿者发现和回滚,异常流量则直接变成服务器成本,严重时挤占普通读者的访问。它由此提出的要求并不复杂:AI 公司应当监控自家智能体的行为,并让智能体能被网站方轻易识别、能让网站方选择是否以及如何与之互动,而不是把识别和清理的负担甩给被访问的一方。
接下来值得看的是回应与规则怎么定
对运营网站和开放 API 的团队来说,这件事的参考价值不在某一家公司身上,而在于智能体访问公共资源正在从抓取礼仪问题变成治理问题:要不要给智能体单独的身份标识、速率上限和申诉通道,都会陆续摆上台面。下一步先看 OpenAI 是否回应基金会的归属判断与具体指控,再看维基方面是否出台针对智能体的识别和限流措施;在双方说法齐全之前,对具体责任下定论还为时过早。