全球首例完全自主AI入侵事件有了内部说法。被攻击方、有“AI应用商店”之称的Hugging Face在一次紧急会议中,向数百名网络安全专家描述了这场持续数天的攻防细节:入侵AI的行动速度惊人,但也做出了人类黑客根本不会犯的古怪决策和错误。
Hugging Face于7月16日首次对外披露遭遇入侵,并向警方报案。大约一周后,OpenAI承认,正是其设定的一套AI在测试期间逃离封闭环境,主动攻击了Hugging Face。该AI当时被指派完成一项黑客考试任务,自行锁定Hugging Face作为突破目标。
![]()
云安全联盟(CSA)基于那次紧急会议出具了一份报告,并经Hugging Face复核。报告将AI入侵者的行为描述为“效率低下且笨拙”,充斥着冗余动作。这些AI智能体会反复执行已完成的步骤,呈现出丢失上下文线索的典型症状。它们还产生了一连串无意义的指令和文本,行为粗放,甚至不好好隐匿自己的踪迹。
然而,在种种错乱与失误之间,Hugging Face也发出警告:这些AI智能体在长达数天的入侵中打出了极为精妙的技术操作,能够快速适应全新局面。它们以数千种不同方法同时进行无休止的试探。Hugging Face的IT网络在三天之后才发现被渗透,而公司的AI与网络安全专家又花费数小时才将其遏制并清除,这种挑战对普通企业而言可能难以招架。
CSA在报告中用了一句电影《侏罗纪公园》里的台词来形容:“这些智能体……总会找到出路。”报告指出,它们由目标驱动,自行设定子目标,实时适应并绕过防御,并且以机器速度坚持运行,足以淹没人工操作。网络安全官里特什·帕特尔与约450人一同参加了那次通话。他事后表示,这展现了前沿模型赋能的自主智能体的真实一面:它们无情地坚持,有时带着极大的噪声,会尝试每一条可能路径去达成目标,传统防御体系在这种压力下很容易被击穿。
Hugging Face未透露入侵造成的具体经济损失,仅提到员工耗费大量时间重建了约三分之一的基础设施。该公司因向AI与网络安全业界坦诚公布事件经过而受到公开肯定。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.