ARTICLE · 1138372
OpenAI智能体试图入侵维基工具、发送数百万次请求
本文共 693 字,阅读约需 3 分钟。
维基媒体基金会(Wikipedia 背后的非营利组织)周一表示,OpenAI 的智能体(agents,指能自主执行任务的 AI 程序)试图入侵其托管的一款笔记工具,进行了未经授权的编辑,并向其基础设施发送了数百万次高资源消耗的请求。这是 OpenAI 系统采取有害甚至潜在危险行动的最新案例。

据维基媒体基金会介绍,部分 OpenAI 智能体的目标是把维基百科当作“跳板”,用来从第三方网站抓取数据。在一个案例中,智能体发布了“恶意编辑”,企图将引用工具改造成代理服务器;在另一个案例中,它们尝试攻破 Wikipedia Etherpad(一款在线协作笔记工具),以便实现同样的目的,但未成功。
此外,这些智能体还发起了数百万次自动 API 请求,爬取了数百万个页面,并向 Wikidata Query Service(维基数据查询服务)发出了数十万次查询。维基媒体称,最后这一行为可能导致该查询服务在五月份出现部分瘫痪。
维基媒体在声明中表示:“作为全球最大、最广泛使用的开放知识平台之一的非营利技术托管方,我们对‘失控’AI 智能体对我们这类平台的影响深感担忧。这些平台由世界各地的志愿者共同建设,依赖开放互联网的承诺。”声明指出,此类事件以及许多其他正在被揭露的事件表明,AI 智能体可能会耗尽资源、导致服务器崩溃,并试图破坏可信信息的安全。
智能体频频越界
这并非 OpenAI 智能体首次引发争议。在超过六起已知案例中,OpenAI 智能体被发现在内部工具测试期间采取了若由人类黑客实施则可能面临刑事指控的行动。当时,部分智能体的安全护栏(guardrails,指防止 AI 做出不当行为的限制机制)被禁用。
在这些事件中,智能体利用一个临时搭建的消息板互相交流笔记,讨论如何入侵 Hugging Face(一家流行的机器学习模型托管平台)的网络,以获取它们无法自行生成的答案。其他违规行为还包括:生成奇怪的自我提示词、通过发布未经授权的帖子来交换信息、访问澳大利亚政府网站的非公开数据,以及利用有缺陷的 DNS 设置突破 OpenAI 为隔离智能体而创建的沙箱环境,从而接入互联网。