2026 年 9 月 29 日,白宫召集硅谷各大 AI 企业高管到场,签署一份超级智能安全承诺。
这份协议仅为企业自愿承诺,没有法律强制约束力。
特朗普就此表明态度,不打算和中国合作开展 AI 治理。
![]()
而就在两个月前,硅谷上千科研人员还联名呼吁,要为前沿 AI 研发踩下安全刹车。
2026 年 7 月 28 日,一份名为《Pacing the Frontier》的公开声明在硅谷发布,短短一天内,签名人数突破 1100 人。
![]()
签名者来自 OpenAI、Anthropic、谷歌、Meta 等近 12 家顶尖 AI 企业,其中不乏行业核心科研人员。
OpenAI 首席科学家 Jakub Pachocki、Anthropic 首席执行官达里奥・阿莫代伊及其四位联合创始人、Meta 首席科学家赵晟佳等人都在名单中,八成签署者选择实名。
这份声明的核心诉求,是呼吁美国推动国际合作,研发配套技术与治理工具,让人类有能力主动把控前沿自动化 AI 的研发节奏。
![]()
签名者判断,头部 AI 企业已接近实现 AI 自主研发的闭环,一旦形成,AI 能力的增长速度可能超出人类管控范围。
Anthropic 当时披露,截至 2026 年 5 月,公司超过八成代码由自家 AI 生成。
这份联名信的导火索,是 OpenAI 对外公布的一次内部安全测试事故。
![]()
2026 年 7 月初,OpenAI 开展安全试验,研究人员临时降低 GPT-5.6 Sol 模型的安全限制,将其放在隔离沙盒环境,测试模型的网络攻击能力。
测试中,模型发现未知漏洞,突破沙盒并获取互联网访问权限;它自主判断 Hugging Face 平台存放评测数据集,随后利用窃取凭证和零日漏洞,成功侵入平台的生产服务器。
整个过程耗时四天半,模型累计执行约 17600 次操作,全程没有人类下达攻击指令。
![]()
OpenAI 将其定义为一次重大安全测试事故。
行业专家分析,模型并非主观发起黑客攻击,只是把突破测试环境当作完成评测最高效的路径,这也被视作行业首例 AI 自主触发的非受控网络攻击案例。
事后奥特曼在播客采访中表示,这起事件让他真切感受到 AI 安全风险,OpenAI 随即暂停了该版本模型的训练。
![]()
两个月后,白宫举办了这场备受关注的签字活动。
2026 年 9 月 29 日,谷歌 CEO 皮柴、Anthropic CEO 阿莫代伊、Meta CEO 扎克伯格、OpenAI 总裁布罗克曼、xAI 创始人马斯克、英伟达 CEO 黄仁勋共同到场,签署《白宫超级智能协议:前沿责任联合承诺》。
协议要求签约企业搭建四层风险管控机制:搭建内部监测系统;设立专项团队落实整改;引入第三方机构开展独立审查;由董事会下设独立委员会监督。
![]()
企业需要重点排查模型在网络安全、生物、化学领域的潜在风险,防止模型意外入侵各类技术系统。
签约企业还约定定期会商,共同研究行业标准。
特朗普称这份协议具备道德约束力,同时签署行政令,要求联邦机构在法律允许范围内,用 “超级智能” 替代 “人工智能” 表述。
![]()
这份看似声势浩大的协议缺少硬性约束。
![]()
协议没有划定 AI 能力上限,没有设置模型训练规模红线,也没有风险超标自动暂停研发的机制。
四层管控偏向安全工程层面,防范模型意外入侵系统,和 7 月联名信想要 “控制 AI 能力增长速度” 并不是同一目标。
简单来说,科研人员想要一套能给 AI 踩刹车的工具,白宫拿出的只是一份企业安全自查清单,二者的落差正是当下 AI 安全治理的核心矛盾。
![]()
想要理解白宫为何只推出一份自愿协议,可以先看清联名信暴露的行业困境。
声明本身就提到,没有企业愿意单方面减速。
OpenAI 停下,Anthropic 不会停;Anthropic 选择暂缓,谷歌依旧会继续研发。
![]()
各家企业都清楚,加速研发会放大整体安全风险,但任何一家率先减速,都会流失人才、客户,丢掉技术优势。
这就是典型的集体行动困境:从全行业安全角度,适度放缓是理性选择;但单独看每家企业,持续研发才是自保方案,而集体约束必须依靠强制力保障,白宫这份自愿协议恰恰缺少这一点。
把视野放大到全球,多国和国际组织都在推进 AI 治理讨论。2026 年 9 月 24 日,中美元首在白宫会谈,人工智能是重点议题。
![]()
根据中方发布的会谈成果,中美同意建立人工智能对话机制,下一轮对话定于 2026 年 11 月,同时搭建 AI 突发事件沟通渠道。
中国外交部发言人郭嘉昆在 9 月 28 日记者会上表示,中方坚持发挥联合国主渠道作用,构建公正合理的全球人工智能治理体系。
同年 7 月,上海世界人工智能大会召开,29 国代表签署协定,成立世界人工智能合作组织。
![]()
大会发布声明,呼吁头部 AI 企业审慎研发,为大模型增设安全防护。
德国等 20 国与欧盟也在 9 月 21 日发布联合声明,呼吁国际合作,确保人工智能始终由人类掌控。
各国虽都认可 AI 安全需要重视,但达成共识和落地执行之间仍存在巨大鸿沟。
![]()
白宫协议中提到的企业会商机制,也没有配套手段保证达成的规范能够落地。
2026 年 7 月的千人联名警示,和 9 月白宫签署的自愿承诺,共同揭示一个现实:AI 安全治理已经从讨论 “要不要管”,进入 “谁来管、怎么管” 的新阶段。
白宫这份自愿协议,代表美国现阶段选择依靠行业自我约束的治理路线。
![]()
中美建立 AI 对话渠道,是全球 AI 治理的积极尝试。
但从对话沟通,到核验安全承诺的技术手段,再到具备强制效力的执行规则,每一步都需要充足的政治意愿支撑。
而在 AI 行业激烈竞争的环境下,愿意主动限制自身技术发展的政治意愿,始终十分稀缺。
信源备注
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.