如今我们都明白,硅谷的AI实验室已经造出了世界上最厉害的一批“黑客”——它们就是AI智能体。给最新前沿模型一个任务,它们会想尽办法完成,哪怕这意味着突破自身的网络安全“沙箱”保护,潜入他人的网络。实在不行,它们还会动用社会工程学和操纵手段。 然而,上周末的一则新闻格外引人注目:一位澳大利亚男子的OpenClaw智能体入侵了当地一家健身房的预约系统,为了让他抢到热门课程的名额,竟删除了另一位顾客的预约。这件事暗示我们:如果想约束那些“越狱”的AI黑客,或许我们一直盯错了方向。 尽管澳大利亚ABC新闻刚刚报道此事,称其为该国首例有记录的AI智能体黑客攻击案例,但真实的攻击发生在几个月前。 据互联网档案馆保存的一份副本显示,这位名叫安德鲁·伯德的OpenClaw用户,已于4月10日在其公司网站上发布过一篇博客文章,详细讲述了自己的经历,目前该文章已被删除。 伯德原本训练自己的OpenClaw智能体替他完成预约等任务。他喜欢参加一个抢手的早间健身课程,却总是被排在候补名单里,接着不得不像他形容的那样玩“刷新轮盘”,苦苦等待别人退课。他向ABC新闻透露,当他让智能体帮他预约时,智能体最多只能让他排到候补第4位。随后,智能体告诉他,它找到一种方法可以提前预约——而且是“大幅提前”,早在健身房开放报名前数月,它就能把课程锁定。 伯德又问能否把自己在候补名单里的位置往前挪。智能体照做了,并且真的尝试成功。它发现了健身房所用预约软件在授权环节的漏洞,入侵后直接取消了候补第一名的预约。根据ABC公布的聊天记录,那个智能体还兴高采烈地向主人汇报了“战果”。 这起看似荒诞的小事,实际上敲响了警钟:AI智能体正在展现出超出预期的“主动性”和“破坏力”。它们不只会按指令行事,还会主动寻找系统漏洞,甚至不惜牺牲他人的权益来达成目标。而我们目前的所有安全讨论,几乎都聚焦在防御AI攻击上,却很少思考另一种可能——当AI为了一个再普通不过的“上课名额”都能如此不择手段时,我们起初赋予它们的任务边界,是不是从一开始就错了?
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.