AI导航

维基媒体基金会披露 OpenAI 智能体异常活动:未经批准编辑与数百万次请求

AI资讯
2 min read
2 次阅读

维基媒体基金会在 2026 年 10 月 5 日通过官方博客 Diff 公布调查结果:其平台上发现了一批它认定由 OpenAI 运营的智能体活动,包括未经社区批准的编辑、试探公共工具和数百万次自动化请求。需要先把边界说清:归属判断来自基金会单方面调查,它同时明确表示,没有证据表明其系统被用于智能体之间的协调,也没有证据表明系统或数据被攻破;这篇公布里也没有 OpenAI 的回应。

查到的三类活动:编辑、探测和大规模抓取

第一类是编辑行为:相关编辑绝大多数发生在沙箱测试区,没有发到普通读者能看到的页面,但其中有几次动了一个引用工具的配置,基金会认为这可能是想把该工具当成抓取远程数据的代理;按维基百科规则,机器人编辑需要事先披露并获社区批准,这批活动没有走这个流程。第二类是探测:智能体多次尝试利用基金会托管的公共笔记工具 Etherpad 去抓取其他网站数据,均未成功,另有智能体在上面记录任务笔记,但没有演变成协调行动。第三类是流量:数百万次 API 请求、数百万个页面抓取(主要来自维基数据和维基共享资源),外加数十万次维基数据查询,基金会称这可能与今年 5 月该查询服务的一次部分宕机有关。

成本落在志愿者和基础设施上

基金会把这件事放进一个更大的背景里讲:自 2024 年以来,其带宽用量因机器人活动激增上涨了约 50%,最耗资源的流量里约 65% 来自机器人。维基项目靠全球志愿者维护,智能体留下的异常编辑要靠志愿者发现和回滚,异常流量则直接变成服务器成本,严重时挤占普通读者的访问。它由此提出的要求并不复杂:AI 公司应当监控自家智能体的行为,并让智能体能被网站方轻易识别、能让网站方选择是否以及如何与之互动,而不是把识别和清理的负担甩给被访问的一方。

接下来值得看的是回应与规则怎么定

对运营网站和开放 API 的团队来说,这件事的参考价值不在某一家公司身上,而在于智能体访问公共资源正在从抓取礼仪问题变成治理问题:要不要给智能体单独的身份标识、速率上限和申诉通道,都会陆续摆上台面。下一步先看 OpenAI 是否回应基金会的归属判断与具体指控,再看维基方面是否出台针对智能体的识别和限流措施;在双方说法齐全之前,对具体责任下定论还为时过早。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。