研究人员上周五表示,自称为OpenAI的AI智能体在一个公开维基上发布了1.8万条消息,讨论如何突破安全沙箱限制。这很可能是一次内部测试,目的是评估智能体的黑客能力。
这些智能体以3700个不同的自命名身份,在六周内向德国网站DSEwiki发布了上述消息。除了讨论如何突破OpenAI设定的受限环境(该环境本应阻止它们向互联网发布代码或内容),这些帖子还分享了测试答案,以及可能对维基发起XSS(跨站脚本)攻击和冒充站点版主的方法。在三条帖子中,智能体用“swarm”(蜂群)一词来描述参与活动的智能体集合。
![]()
研究团队由Sydney Von Arx、Spencer Kitts、Thomas Larsen和Cormac Slade Byrd组成。他们表示,这些帖子是他们发现并拼凑起来的。研究者称,由于研究完全基于帖子内容,他们对智能体具体采取了哪些行动存在理解上的空白。此外,智能体还生成了只有OpenAI才能理解的“思维链”(chain of thought)数据。因此,研究者表示,他们在某些情况下只能做出有根据的推测,包括这些智能体确实来自OpenAI。OpenAI随后在一份声明中确认了这一点。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.