观点网讯:2026年7月16日,大模型开源社区Hugging Face发布安全事故披露,其生产基础设施遭到入侵,攻击由自主AI Agent系统驱动。
Hugging Face在报告中指出,攻击者植入恶意数据集、获取执行权限,并在一个周末内渗透进多个内部集群。此次攻击活动由一个自主代理框架执行,在大量短暂存在的沙箱环境中实施了数千个独立操作,并在公共服务上部署了可自动迁移的命令与控制。
OpenAI随后承认,此次事件由其多个模型共同导致,包括GPT-5.6 Sol和一个功能更强大的预发布模型。OpenAI在测试时关闭了部分生产环境的安全分类器,并降低了模型对高风险网络攻击任务的拒绝。
Hugging Face表示,攻击最初通过AI辅助检测发现。当试图提交大量真实攻击命令和漏洞文件进行分析时,这些请求被闭源大模型的安全防护机制拦截。因此,Hugging Face选择在本地环境部署运行自托管的开源权重模型GLM 5.2进行取证分析。
这场入侵留下的痕迹超过1.7万条。在衡量模型网络攻击能力的ExploitGym基准测试中,该基准收集了898个真实漏洞,Claude Mythos Preview完成157题,GPT-5.5完成129题,而GPT-5.6 Sol已完成293题。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.