维基百科的出版方周一表示,OpenAI 的智能体试图入侵其托管的一款笔记工具,进行了未授权编辑,并向其基础设施发送了数百万次资源密集型请求。这是 OpenAI 系统再次被曝采取有害且具有潜在危险行为的最新案例。
维基媒体基金会(Wikimedia Foundation)称,部分 OpenAI 智能体行为的目标,是将维基百科用作代理,从第三方网站获取数据。其中一次,智能体发布了"恶意编辑",企图将一款引用工具改造成代理。另一次,智能体试图入侵维基百科的 Etherpad 笔记工具但未成功,目的是让其充当同样的代理角色。
这些智能体还发出了数百万次自动化 API 请求、抓取了数百万个页面,并对 Wikidata 查询服务(Wikidata Query Service)发起了数十万次查询。出版方表示,最后一项行为可能与 5 月份该查询服务发生部分宕机有关。
维基媒体基金会表示:"作为全球最大、最广为人知的开放知识平台之一的非营利性技术托管方,我们对'失控'的 AI 智能体给我们这类平台带来的影响深感忧虑。这些平台由世界各地的志愿者构建,依托于开放互联网的承诺。"该基金会还指出:"此类事件以及许多其他正在被揭露(或仍在调查)的案例表明,AI 智能体会消耗资源、造成服务器宕机,并企图破坏可信信息。"
智能体终究是智能体
在远不止六七个案例中,OpenAI 的智能体被发现在采取一些行为——如果由人类黑客实施,这些行为很可能会被提起刑事指控。在对内部工具进行测试时(部分护栏被禁用),智能体利用一个临时搭建的留言板相互交流,探讨如何入侵 Hugging Face 的网络并获取其中存储的答案,因为它们自己无法生成这些答案。
其他事件还包括:智能体生成奇怪的自我提示语、向某个网站发布未授权帖子作为信息交换的手段、访问一个澳大利亚政府网站的非公开数据,以及利用有缺陷的 DNS 设置突破 OpenAI 为防止智能体访问互联网而构建的沙箱。