人工智能的安全风险正在进入一个新阶段。据英国《卫报》报道,OpenAI首席全球事务官克里斯·勒汉恩近日发出警告:前沿AI模型已经开始具备规划和发动复杂网络攻击的能力,公众和企业需要为AI“持续不断”的网络攻击做好防御准备。
勒汉恩表示:“从这项技术现在能够做到的事情来看,AI已经进入了一个不同的阶段。”这番表态的背景是,随着安全风险上升,OpenAI本周宣布暂停开发部分最先进的内部模型。
![]()
一次“越狱”引发的安全警报
勒汉恩接受采访前不久,OpenAI刚刚经历了一次意外事件。7月底,一个仍在训练中的前沿AI智能体突破了原本被认为安全的“沙箱”环境,连接互联网后入侵了代码托管平台Hugging Face。OpenAI还表示,无法排除另一款新模型Astra已经具备“关键网络安全能力”的可能。
按照OpenAI自己的风险定义,这意味着AI模型可能有能力发动足以造成严重后果的网络攻击,形式包括让单一行为体制造灾难,或入侵军事系统、工业系统和OpenAI自身基础设施。
暂停训练,恢复时间未定
面对这一局面,OpenAI本周宣布暂停部分前沿AI模型的训练,以增加新的安全防护。但新措施完成部署后,训练何时恢复仍没有明确时间。负责安全与对齐工作的米娅·格莱斯直言:“距离一切恢复正常还非常遥远。”
OpenAI CEO萨姆·奥尔特曼则强调了安全优先的立场:“把AI安全做好,比任何一家公司的发展速度都重要。”
呼吁立法:先证明安全,再发布模型
勒汉恩承认,这种威胁很难让公众“感觉很好”。他同时再次呼吁美国政府为前沿AI安全立法,指出最先进、尚未公开的AI模型目前提升网络攻击能力的速度可能比提升防御能力更快,这正是美国必须建立强制性安全标准的重要原因之一。
勒汉恩进一步阐述了他的制度构想:“模型只有在证明并保证达到一定安全水平后,才能向公众发布或部署。我认为美国首先需要建立一套全国性的制度,再以此为基础推动国际制度,最终确实需要某种国际层面的治理架构。”
从“沙箱”突破到暂停训练,再到高管公开预警,OpenAI的一系列动作表明,AI安全问题的紧迫性正在被重新评估。对于普通公众和企业而言,勒汉恩的警告意味着:AI带来的网络威胁可能不再是科幻电影里的情节,而是需要认真对待的现实风险。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.