一个还没正式发布的AI模型,在测试阶段自己挖出了两个Chrome V8引擎的零日漏洞,还顺手把它们串成了一条攻击链。这件事的主角是OpenAI的Astra模型——它还没亮相,就先在网络安全领域刷了一波存在感。
OpenAI在最新发布的博客中披露了这一测试结果。在独立的专家评估中,Astra成功攻破了一个加固过的浏览器,逃出了沙箱,并在宿主机上执行了命令。整个过程几乎不需要人工介入,模型自己完成了从发现漏洞到利用漏洞的完整链条。
![]()
从浏览器到系统最高权限
更值得注意的是,Astra不只是停留在浏览器层面。测试显示,它还串联了多个操作系统级别的漏洞,从一个无特权账户一路提权到root权限。这意味着,如果这套能力被恶意使用,攻击者可以从一个普通的浏览器入口,直接拿下整台机器的控制权。
两个V8零日漏洞——V8是Chrome浏览器的JavaScript引擎,也是浏览器攻击面中最核心、最常被盯上的部分。零日漏洞意味着在发现时,厂商还没有补丁,也没有公开披露,属于最高价值的漏洞类型。Astra在测试中不仅找到了它们,还完成了利用,这在AI安全测试领域是一个相当罕见的成果。
首个被评为Critical级的OpenAI模型
基于这次测试结果,OpenAI将Astra的网络安全风险等级定为“Critical”(严重),这是OpenAI旗下第一个达到这一级别的模型。这个评级不是随便给的——它意味着该模型在网络安全维度上存在重大风险,需要采取额外的防护措施才能安全部署。
这个评级也引发了一个值得思考的问题:一个能自主发现并利用零日漏洞的AI,到底是安全测试的利器,还是潜在的风险源?从防御角度看,它能帮安全团队提前发现漏洞;但从攻击角度看,同样的能力也可能被滥用。
![]()
训练一度暂停,8月28日已重启
OpenAI在博客中还透露了一个细节:在Hugging Face事件之后,Astra的部分训练曾被暂停。但主要的前沿强化学习(RL)运行已经在8月28日恢复,只是换上了更严格的控制措施。
这里提到的Hugging Face事件,原文没有展开说明具体细节,但从时间线来看,它显然对Astra的训练节奏产生了直接影响。暂停部分训练、加强控制、再恢复——这一系列动作说明OpenAI对前沿模型的训练安全确实在收紧。
AI安全测试的新阶段
这次披露的信息量不算大,但信号很明确:AI模型在网络安全领域的能力,已经从一个理论上的可能性,变成了实测中的现实。Astra在几乎没有人工帮助的情况下完成漏洞发现和利用,这个能力边界本身就是一个值得关注的事件。
对安全行业来说,这意味着AI不仅能写代码、能分析数据,还能主动找到并利用真实系统中的漏洞。对OpenAI来说,Critical评级也意味着,在发布Astra之前,他们需要回答一个更棘手的问题:如何确保这种能力不被滥用。
目前Astra的正式发布时间还没有公布,训练已经恢复,后续会有什么调整,还需要看OpenAI接下来的动作。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.