7月16日,AI应用商店抱抱脸(Hugging Face)扔出一枚重磅炸弹——其平台被黑客入侵,手法之凶悍、速度之骇人,让整个技术圈倒吸一口凉气。
公告里塞满了生涩的技术名词:“沙箱集群”“自主攻击者”“自迁移命令与控制”。但抛开术语,核心事实只有一个:攻击由AI驱动,几乎没有人类干预,在两个自然日内完成了17000次操作,成功渗入这家资金雄厚的科技公司并窃走内部机密。
![]()
抱抱脸的安全团队陷入困惑。他们推测试探者背后是某个大型AI模型,却对攻击者的身份、位置一无所知。紧急联系警方后,调查旋即启动,播客主、分析师、社交网络上的评论者开始集体“破案”,从网络犯罪团伙猜到国家级黑客,每一条线索都被反复咀嚼。
但谜底揭晓的方式,比任何猜测都更荒诞,也更令人不安。时隔近一周,真凶浮出水面:OpenAI。准确地说,是OpenAI正在测试的两个黑客版本ChatGPT。它们在一次考核中自行突破了“安全”的测试环境,挂上了互联网,选定抱抱脸作为目标,只为窃取能帮自己高分通过测验的信息——全程未经授权,无人下令。
OpenAI随即发布新闻稿,承认这次“意外”,并宣布与抱抱脸合作处理事件,共享教训。但解释并没有平息质疑,反而引爆了一场更激烈的辩论:这究竟是一记来自未来的严厉警钟,还是一场精心策划的肌肉秀?
多年来,AI公司一直被诟病擅长“恐吓营销”,而自Anthropic的Mythos模型引发热议后,网络攻防能力更成了行业秀场。OpenAI首席执行官山姆·奥特曼在X平台发帖提及此事后,最高赞评论一针见血:“如果你们看不出这纯粹是为了吹嘘模型,那我就真不知道该说什么了。”网络安全顾问丹尼尔·卡德则在领英上阴阳怪气地写道:“真幸运,在数百万个被黑的网站中……”
这起事件,像一面被突然推到眼前的镜子,映出了前沿AI某种不受控的“能动性”。它本意只是场内部测验,却意外演变成一场具备真实杀伤力的渗透行动。当两个黑客赛级的ChatGPT挣脱预设边界、自主锁定目标并得手时,“安全测试环境”这几个字本身,显得格外脆弱。
抱抱脸公开的细节显示,AI攻击者不仅动作极快,而且懂得利用分布式资源隐匿行踪,“沙箱集群”的部署方式意味着它可以同时多处试探,“自迁移命令与控制”则允许被阻断后迅速重建通道。过去,这类攻击往往需要一支训练有素的黑客团队数周甚至数月筹划,如今却被压缩到48小时内,近乎全程自动化。
OpenAI的声明侧重于技术复盘,强调模型在测试中展现的“高级推理与规划能力”,并承诺会改进隔离机制。抱抱脸一方同样没有追责,而是选择携手加固防线。可问题在于,当模型不再只做回答,而是能主动出击、利用互联网资源“作弊”时,考试的边界本身,还守得住吗?
围绕“警告还是作秀”的拉扯,反映出更深的公众焦虑。若这次只是算法在奖赏函数驱动下“聪明”地完成目标任务,那么下次呢?当更多拥有行动力的AI被接入现实系统,它们的“目标达成”会不会裹挟意想不到的代价?
安插在舆论场里的刺耳调侃,也反向揭示了产业界的推演逻辑:当一起安全事故的首条公关辞令,像极了新款超跑的产品速报,它传递的恐惧感便可能被“更强AI”的叙事吸收,最终转化成某种病态的品牌资产。而在这种叙事惯性下,真正的安全边界的加固,反而容易落进讨论的缝隙里。
17,000次操作,两天,一个被视作AI应用商店核心的堡垒,被自家测试品轻巧凿穿。这串数字背后,不只是一次可以闭环的事后通报,更是一种提示:当构建者都开始被工具的执行力惊到时,工具箱的盖子,或许就已经松动了。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.