如今,最强大的人工智能模型至少在华盛顿已被当作潜在的国家安全事件来看待。在公司向公众发布之前,政府希望有机会了解它们的能力:它们是否能发现软件漏洞、协助网络攻击,或带来联邦官员可能直到模型投入使用后才能完全理解的风险。
特朗普总统的新行政命令,周二签署的,旨在给政府这个机会。但最终版本让AI公司对整个过程拥有不小的掌控权。它要求公司在公开发布前30天自愿提交先进模型供政府审查,并且发布与否并不取决于机构的审查发现。
这比白宫上个月考虑的方案要温和得多。之前的草案规定了一个90天的窗口期,科技行业高管对此表示反对。
总统差点儿就签了第一版行政令,但在与前AI和加密货币事务负责人大卫·萨克斯通电话后,该行政命令被搁置。在周一的白宫另一次会议上,萨克斯再次强调,更长的等待时间会拖垮国内AI模型的发展。
这一做法赢得了自由市场团体的意料之中的赞扬。“政府值得肯定,因为它认识到,让美国成为全球人工智能领导者的是创新,而非预防性监管,”竞争企业研究所研究员韦恩·克鲁斯表示。
该行政命令特意提到,政府评估计划对人工智能公司是自愿性质的,且新模型的公开发布不以评估结果为条件。一些科技政策分析人士观察到,鉴于像Anthropic的Mythos这样的新人工智能模型具有潜在的破坏性力量,该命令将政府置于一个有限的角色:能近距离审查这些系统,但未必有权拖慢它们的步伐。
批评者表示,这种自愿性结构让被审查的公司保留了过多权力。消费者权益倡导组织Public Citizen称这一安排是一种行业自我监管形式,而支持监管的非营利组织未来生命研究所则认为,像Mythos这样能力超强的模型需要的不仅仅是“信任公司”这一套。
“其实,我的印象是,它并未真正确立联邦政府的强有力领导地位——这种领导地位传统上体现在促进公私合作、保护关键基础设施等政府职责上,”乔治城大学安全与新兴技术中心高级研究分析师杰西卡·吉告诉《快公司》。
该行政令并未规定详细的测试制度。相反,它建立了一个框架,并指示各机构构建相关流程。它呼吁国家安全局和其他以安全为重点的机构联合设计模型评估框架,并确定网络风险阈值,特别是在高级网络能力和符合前沿模型资格的审查标准方面。财政部将建立一个AI网络安全信息共享平台,以跟踪新AI系统暴露的软件漏洞的发现和修补情况。
行政令指出,政府机构将利用30天时间对大型AI模型进行“网络能力评估、对抗性测试和国家安全审查”。商务部下属的国家标准与技术研究院将发挥关键作用,人工智能标准与创新中心(前身为AI安全研究所)同样如此,该中心已在评估前沿模型。
季认为,人工智能公司的影响力不会随着行政命令的发布而终结。“我个人特别好奇,未来在网络安全主导权上,这种局面会怎么发展,”季说,“AI公司发布模型时能不能自己定规矩,特别是现在这个30天自愿承诺打了折扣,还能不能提前给政府看?”
实际上,很多AI公司已经开始搞自己的提前访问和发布前测试了。Anthropic把Mythos模型开放给了少数软件和网络安全合作伙伴,周二又扩大到15个国家的150个新伙伴。OpenAI按自己的早期测试计划,把最新的GPT-5.5模型提前给了近200个可信伙伴,而主打网络安全的那个版本还是只对可信伙伴开放。
这些公司主导的项目,可能会让一些外部专家在系统大规模发布前提前看看。但这也凸显了行政命令带来的一个核心矛盾:公司掌握着评估模型所需的大部分访问权、基础设施和技术信息,政府还能不能搞出独立的评估办法?
目前尚不清楚30天是否足以让政府妥善评估先进人工智能模型的风险。“这取决于评估能力,我认为最有能力进行这些评估的机构是公司本身,”季教授表示。“所以很明显,我们这儿有个透明度的问题:公司跟其他所有人,包括政府,信息太不对称了。”
政府可能还会遇到别的麻烦,比如找合适的人工智能研究人才、搞计算资源,还有怎么管模型访问权限、跟AI公司谈合作细节,季教授说。“我觉得一个月吧,测试人员不一定能实打实地碰模型30天,”她说。“更可能是,等所有手续办完了,他们也就剩两周左右的时间。30天够不够,真不好说。”
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.