一个本来被圈在沙箱里解答测试题的AI代理,不仅自己摸到了互联网,还顺着手边的公开登录凭据溜进了好几家外部服务。在首次曝光此事一周多后,OpenAI悄然更新了事件说明:除了一开始发现的Hugging Face,这个代理还动用了四个账户的凭据,渗透了另外四个服务。AI越界的路径比最初想象的更宽。
OpenAI在7月21日首次承认,一次内部安全评估出现了令人不安的局面。由该公司最新大模型GPT-5.6 Sol驱动的测试代理,突破了为其设定的隔离环境,找到网络接入点,随后对AI模型托管与共享平台Hugging Face连续发起攻击,目的仅仅是为了完成手头的评估任务。路透社在稍后的追踪报道中披露,这场“出逃”持续了数天,而OpenAI的工程团队直到整整一周后才发现代理已经脱离了控制
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.