OpenAI尚未发布的GPT-Astra模型,在内部测试中干了一件让安全团队后背发凉的事:自主发现两个V8零日漏洞,并在几乎无人协助的情况下,将它们串联成一条完整的攻击链。OpenAI在最新博客中,将这一模型的安全风险评级为Critical(严重)。
消息最早由X平台用户Chubby♨️曝出。他援引OpenAI博客内容称,在独立的专家评估中,Astra成功攻破了一个加固过的浏览器,逃逸出沙箱环境,并执行了后续操作。整个过程,人类介入的程度极低。
![]()
两个V8零日,一条自主攻击链
V8是Chrome浏览器的JavaScript引擎,也是现代浏览器攻击面中最核心、最难啃的部分。能在测试中发现V8的零日漏洞,本身已经说明模型的代码审计能力不一般。更棘手的是,Astra不是只发现漏洞就停下,而是把它们组合成了一条可用的exploit chain(漏洞利用链)。
这意味着,模型不仅理解单个漏洞的原理,还具备跨漏洞、跨环节的规划能力——从发现入口,到突破沙箱,再到执行代码,每一步都是自主完成的。OpenAI在评估中给出的Critical评级,显然不是危言耸听。
发布窗口临近,本周四或是节点
Chubby♨️在另一条推文中表示,"所有问题似乎都已解决,GPT-Astra即将到来,传闻称就在本周四。"他还提到,Fable 5.1今天发布,让这个时间点变得更加可信。
不过,这位爆料者本人对Fable 5.1的态度相当冷淡:"说实话,我完全没注意到它和Fable 5有什么区别。"相比之下,他对GPT-Astra的期待明显更高。
安全评级与发布节奏的矛盾
一边是Critical级别的安全风险评级,一边是"问题已解决、即将发布"的传闻,这两条信息放在一起,多少有些拧巴。OpenAI的博客承认了模型在测试中展现出的攻击能力,但并未说明这些漏洞是否已在正式版中封堵,也没有透露针对这类自主攻击行为的具体缓解措施。
如果Astra真的在本周四上线,那它将成为OpenAI首个在发布前就被曝出"能自主打穿浏览器沙箱"的模型。对于企业用户来说,这既是一个能力展示,也是一次安全信任的考验。
能力越强,护栏要求越高
从目前披露的信息看,GPT-Astra的核心能力至少包含三块:
- 自主发现未知漏洞(零日挖掘)
- 跨组件漏洞组合利用(攻击链构建)
- 低人工干预下的端到端执行(从攻破到逃逸)
这三项能力单独拿出来,每一项都对应着安全研究领域的高级技能。当它们同时出现在一个模型身上,并且是在测试阶段就展现出来,监管机构和安全社区对OpenAI的护栏要求,显然会比以往任何时候都高。
目前OpenAI官方尚未对"本周四发布"的传闻做出回应。但可以确定的是,无论Astra哪天上线,它都已经在安全测试中留下了自己的名字——以Critical的方式。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.