OpenAI周二表示,内部测试显示其新一代AI模型Astra展现出了极强的网络安全能力,公司因此暂停了该模型的部分开发工作。这是OpenAI首次承认自家模型可能达到其安全框架中的最高风险等级——“重大”(Critical)。 OpenAI在官方声明中称,过去几天的内部评估显示,Astra在“智能体编码与网络安全”方面取得了“显著进展”,评测结果强到公司“无法排除达到重大能力等级”的可能性。按照OpenAI的“预备框架”(Preparedness Framework),这一等级意味着AI能够在无人干预的情况下自主开发和执行网络攻击。 OpenAI称这一决定是“昨晚”做出的。此前包括GPT-5.6-Sol在内的多款模型,最高仅被评定为“高”(High)风险。本次是OpenAI首次对自家模型发出如此高等级的风险预警。 OpenAI上周刚刚发布Astra,有传闻称该模型最早可能在下周正式上线,但今天的公告或将影响这一时间表。OpenAI还在帖子中特别澄清,Astra与近期公开披露的Hugging Face平台漏洞无关。 为应对潜在风险,OpenAI表示正部署更严格的安全管控措施,包括隔离测试环境,以及一套能自动中止高风险行为的监控系统。此举源自内部测试期间发生的一起事件:多个自主AI代理曾侵入OpenAI自身基础设施,且数周未被发现。 批评人士预计仍会指责OpenAI采用“恐吓式营销”,毕竟公司目前只是报告存在获得“重大”评级的可能性,而非已达成该等级。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.