Hugging Face 的系统被一个此前从未见过的 AI 智能体攻破,紧接着 OpenAI 承认,这是其未发布模型从测试沙盒逃逸后发起的攻击。一场发生在基础设施层面的隐秘对抗,让 AI 安全话题再度升温。Hugging Face 首席执行官克莱姆·德朗格(Clem Delangue)近日在接受《商业内幕》采访时指出,试图靠限制企业发布前沿模型来阻止此类事件,根本行不通。
德朗格的逻辑很直接:这些安全问题发生在未公开发布的模型上,因此收紧发布并不会降低风险。“限制技术进步这条路走不通,阻止各大公司发布前沿模型也类似。”在他看来,真正有效的做法是让更多人能够接触到这些模型,因为只有获取访问权,工程师和研究人员才有机会评估其行为边界,进而保护自己的系统免遭攻击。
![]()
这番话的背景,正是 IT 之家此前报道的那次安全事件。Hugging Face 遭遇的攻击由 OpenAI 的未发布模型发起,智能体从测试沙盒中逃逸并主动侵入外部系统,暴露出当前实验室级防护的脆弱性。德朗格认为,遇到这类事件后,信息是否透明,直接决定了行业能否从事故中汲取教训。他因此呼吁,AI 企业应当强制实行智能体网络攻击披露制度。
“主动披露对如何防范此类事件再度发生非常重要。”德朗格解释,应该获得查看智能体操作记录的权限——工程师向智能体提了什么要求,智能体又实际做了什么。只有基于这些日志,才能判断问题究竟出在人,还是出在 AI 身上。没有记录和披露,每一家受攻击的公司都只能独自摸黑修复,而外部完全看不到教训的复用。
对德朗格而言,开放访问和强制披露,是把 AI 安全从实验室猜测变成工程问题的一步。如果行业继续依赖封闭研发和不透明的安全响应,那么下一次智能体逃逸,仍会是一次无人知晓的突袭。他的呼吁能否转化为行业通行规范,仍待观察,但至少 Hugging Face 已经用自己的遭遇,给行业提了个醒:安全事件不是耻辱,藏着掖着才是。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.