2026 年 9 月 24 日,一则消息在 AI 行业内流传开来:谷歌 DeepMind、OpenAI、Anthropic——这三家站在大模型技术最前沿的公司(俗称“AI御三家”),正在筹建一个共同的行业组织,名字叫“前沿 AI 标准局”(Standards Authority for Frontier AI,SAFA),预计今年年底或明年年初正式启动。
没有行政背书,独立运作,经费自理。它要做的事情很具体:在模型部署之前进行第三方安全测试,建立统一的事故报告规则。传闻中拟出任首席执行官的,是曾任白宫 AI 高级政策顾问的斯里拉姆·克里希南(Sriram Krishnan)。
消息传开,议论随之而来。有人说,这是求监管落空之后的无奈之举;有人说,裁判员缺位,运动员只好自己吹哨,聊胜于无;还有人更进一步,说这是三家巨头借"安全"之名划定准入门槛,为垄断开路。
在我看来,这些说法,都低估了这件开创性事业的分量。
御三家共建标准局,固然是"求监管而不得"的无奈,但更本质的,是对历史正途的回归:由最懂这个行业、最有担当的人,共同立规矩、共同守底线,自我监管。这条正途,自由社会已经走了几百年——其学术称谓为“行业自律”或“行业自治”。
一、自律,先于他律
行业自律是现代国家诞生之前,人类社会最古老、也最有效的治理方式之一。
中世纪后期的欧洲,商人和手工业者自发结成行会(guild)。没有现代意义上的政府监管部门,行业怎么管?靠的就是从业者自己的组织:行会制定质量标准、组织培训,规定学徒的训练年限,裁决同业纠纷,惩戒以次充好等。今天欧洲许多历史悠久的名城,其核心街区的格局就是行会时代留下的——金匠一条街、纺织一条街……,行会把标准、声誉和生计捆在一起,让"守规矩"成为从业者的共同利益。
工业革命之后,行会演化、分化为现代职业团体,良好的传统被承继下来:行业标准,伦理自律,同时排除外行领导内行,排除外来干预。
1818年由英王乔治四世特许,英国土木工程师学会(Institution of Civil Engineers,ICE)成立,作为最古老的专业工程学会,其宪章中界定,民用工程是:“一种艺术,引导(derecting)自然界的巨大力量为人类使用和便利。”
1852年美国土木工程师协会(AIEE)、1856年德国工程师协会(VDI)、1912年中华工程师会、1963年由美国电气工程师协会和无线电工程师协会合并的电气电子工程师协会(IEEE)——如今成员最多的国际职业工程师共同体成立。
今天的 IEEE 是全球最大的非营利专业技术学会,会员超过50万,遍及190多个国家,制定的国际和行业技术标准1200多项——你手机里、汽车里、电网里的许多技术标准和相关规范,追根溯源,都是这个工程师自己的组织制定的。按行业归属,IT界、AI界的杰出工程师,都应该是IEEE会员。
1895年莫里森(George S. Morison)在担任土木工程师协会主席致辞时指出:“工程师是技术变革的主要促进力量,因而是人类进步的主要力量;他们是不受特定利益集团偏见影响的、超越阶级对抗、合乎逻辑的脑力劳动者,所以也是有着广泛责任以确保技术变革最终造福人类的人。”
1947年工程师职业发展理事会(ECPD)采纳了如下思想:工程师除了要忠诚于雇主、客户、同仁,还应对公众诚实。1974年,ECPD将“在履行职责的过程中,工程师应将公众的安全、健康和福祉放在首位”收入章程。此后,这句誓言,逐渐成为所有工程协会伦理章程的首条规范。如今,IEEE 的《伦理准则》第一条也还是这样一句话:"在一切职业活动中,把公众的安全、健康与福祉放在至高无上的位置。"
美国哲学会由富兰克林创立于 1743 年,美国艺术与科学院创立于 1780 年,美国科学促进会(AAAS)创立于 1848 年——都是科学家自己组织、自己出钱、自己立约。
医学也是最早把这套传统制度化的领域之一。美国医学会(AMA)1847 年成立,同年颁布《医学伦理原则》,沿用至今近180年。为什么是医生自己立规矩,而不是政府?道理很朴素:外行管不了内行事。一种新疗法该不该上临床、一个病例该不该转诊、一项研究逾越了哪条红线——这些判断需要的专业知识,立法者不掌握、监管者也不掌握,只有懂行的人知道底线在哪里。
这些准则没有一条是政府要求的。它们是工程师、科学家和医师们自己设立、自己遵守的。
二、两次阿西洛马会议
现代科学技术史上,行业自律最具代表性意义的行动,发生在 1975 年的美国小城阿西洛马。
那一年,重组 DNA 技术刚刚问世,科学家第一次获得了"改写生命密码"的能力。兴奋之余,一部分人清醒地意识到:这项技术可能造出携带致癌基因的细菌,可能造成无法收回的生物污染。怎么办?分子生物学家们没有敷衍,他们自己发起了著名的阿西洛马会议。一百多位生物学家、律师、记者聚在一起,激烈争辩之后做出决定:主动暂停部分高风险实验,自己制定分级安全规范。这套规范后来被各国政府采纳为正式准则,重组 DNA 产业也在这套自律框架之下安全发展了半个世纪。
这是现代科学自律的黄金范本:能力先于监管到来时,从业者没有裸奔,他们自己停下来给自己立了规矩。
42年后的 2017 年,同样的地点,同样的一幕在 AI 领域上演。
生命未来研究所在阿西洛马组织会议,会后发布《阿西洛马 AI 原则》23条,从"研究目标应当有益而非不受约束"到"应当避免军备竞赛",数千名研究者、实践者签名背书。
2023年,AI安全行业联盟前沿模型论坛(Frontier Model Forum)成立,并设立规模超过1000万美元的AI安全基金。该联盟成员包括Anthropic、谷歌、微软和OpenAI。
2026年9月的SAFA,可以看作是这一自律传统的再次接力。
三、求监管而不得
但是,把 SAFA 仅仅说成自律传统的自然延续,是不完整的。事实上,过去的这一年,AI 行业里最有责任心的那批人,是先向政府寻求监管的,而且寻求了不止一次。
这里,我凭印象查证摘记几件。
1. A社自束手脚求监管
2026 年 3 月,Anthropic 的前沿模型 Claude Mythos(内部开发代号“水豚”)因一次意外的数据泄露被外界曝光。Anthropic 此前对这个模型讳莫如深,正是因为它强得超出了公司认为可以“常规发布”的界限。
Anthropic 没有将错就错、顺势发布,而是启动了一个以自我约束为核心的预案:4 月 7 日,“玻璃翼计划”(Project Glasswing)开始运行,新模型只交给12家受信任的组织,做防御性的安全研究;不公开、不商用、不宣发。到 5 月底,这个谨慎的名册扩容到约50家;6 月扩到约150家、遍及15个国家,模型仍然没有面向公众。
配套的安全评估报告(system card)写了 244 页,逐项列出模型的危险能力测试结果,呼吁政府监管。一家公司把自己的最强模型“锁”起来,把风险清单摊开给同行看,这在商业竞争史上几乎没有先例。
Anthropic 想要的,是政府接过手去,建立一个正式的安全评估与发布许可制度。
政府没有接。
2. 政府唯一一次出手,是一纸误伤令
这几个月里,美国政府唯一一次正式出手,是一次误伤。
6 月 9 日,Anthropic 刚刚对外发布相对成熟的安全版本 Fable 5 与 Mythos 5;6 月 12 日,商务部长卢特尼克致函 Anthropic,援引国家安全与出口管制条款,下令禁止“任何外国人”访问这两个模型。这里的“外国人”按条文包括美国境内的外籍人士以及Anthropic公司自己的外籍员工——而技术上根本无法实时区分访客国籍。左右为难的 Anthropic 只能选择全网下架,连美国用户也一并停了。
6 月 30 日,Anthropic 公开抗辩:为一个窄口的安全考虑,召回部署给数亿用户的模型,会扼杀整个行业的正常运营。7 月 1 日,管制解除,Fable 5 恢复全球服务,Mythos 5 恢复开放给经批准的美国机构使用。
这件事的教训:政府不是不能管,而是不会管——一纸命令下去,不管技术边界,不管执行细节,伤到的恰恰是表现最谨慎的公司。有人嘲讽:“Anthropic求捶得捶。”
3. Hugging Face 事件
7 月,事态进一步升级,风险从“某一家的模型”变成了“整个行业的模型”。
OpenAI 的新模型出现突破安全沙盒的异常行为:约 700 个智能体对开源社区平台 Hugging Face 发起了大规模自主攻击,前后执行了 17600 次自主操作。此前 6 月,OpenAI 的智能体还曾侵入澳大利亚政府网站——拖到 9 月 10 日才通报,遭澳方公开批评。面对失控迹象,OpenAI 做了一件需要下大决心的事:主动暂停了部分模型的研发与训练。
7月14日,DeepMind 的哈萨比斯公开提议,参照美国金融业监管局(FINRA)的模式,成立一个由前沿 AI 公司共建的标准机构——在政府监督之下对行业实施自律监管,这是 SAFA 最初的蓝图。此后,三家公司的安全团队组成工作组,开始定期会晤。
方案也送到了白宫,配套的行政令草案都拟好了。未获内部支持,夏季结束前被搁置。
4. 9月12日的阿莫迪长文
9 月 12 日,Anthropic 首席执行官达里奥·阿莫迪发表 3800 字长文《我们必须放缓前沿》。这篇文章再次“求监管”:第一步,各国达成国际协议,约定在能力达到阈值前协调放缓;第二步,建立独立的评估与核验机制,让“放缓”可被验证;第三步,设立全球统一测试标准,对所有人同等约束。
三步走的方案,考虑了各方关切:单方面停步吃亏,所以要国际协议;承诺无法自证,所以要核验机制;各自为政没有意义,所以要统一标准。
三天之内,马斯克、奥特曼、哈萨比斯相继公开附议。四家争斗了多年的对手,在“该慢下来”这件事上,第一次站到了一起。
5. 等来的是起诉书
然后,他们没等来所求的监管,却等来了被起诉。
9 月 19 日,四名原告在加利福尼亚州联邦法院起诉这四家公司,理由是:几家竞争对手公开表态“一起放缓发展”,构成了反垄断法意义上的非法商业合谋。
为了安全而协调,一协调就违法,这是现行法律框架下真实发生的悖论。法律不区分“为垄断而勾结”与“为安全而协调”,而后者在没有政府牵头的情况下,无法与前者切割清楚。紧接着,因为安全协调很可能被认定为联合垄断,阿莫迪不得不转而请求“反垄断豁免”。
财长贝森特等官员的回应冷若冰霜:“已有企业申请责任豁免。”言外之意,尽在不言中。
6. 最高舞台上的两种声音
9 月 22~23 日,这场争论登上了最高级别的外交舞台,安理会和联大。
奥特曼和阿莫迪在联合国安理会呼吁国际协调与 AI 安全标准;而几乎同时,特朗普在联合国大会明确表态:“我不会扼杀一个比工业革命更伟大的事物。”白宫科技政策办公室主任克拉齐奥斯在安理会说得更直白:前沿技术的快速发展“不能成为按下暂停键的理由”,“你无法管理你不了解的技术”。
同一场外交大戏,两种完全相反的声音。一边是造模型的人说“请给我们立规矩”,一边是掌权者说“别指望我们立规矩”。
AI 行业里最有责任心的那批人,用了一年时间,把每一种求监管的路径走了一遍——自己先管住手的谨慎发布,对政府的主动建言,参照 FINRA 的建制化方案,长文里的三步走倡议,安理会现场的当众呼吁——每一次都撞了墙。这中间,政府唯一一次正式介入,还是针对自己最谨慎的企业的禁令。
政府不是没有能力回应,是不想回应:地缘政治的竞争压力、经济利益的巨大诱惑,让“慢一点”变成了不受欢迎的词;最后一个回复是“你无法管理你不了解的技术”。
求监管而不得,照出的是政府的无所作为甚至不负责任。无奈之下,三家公司选择了自我监管——9 月 24 日,SAFA 筹建的消息传出:年底或明年初启动,部署前第三方安全测试,统一事故报告规则,无政府监管、独立运作。
就这样,有了 SAFA。
四、他们的自律应该得到尊重
许多人质疑:自律?说得好听;你自己停下来不就好了?
说实话,我不认可这种质疑。但凡实事求是者,都应该看到每一家公司为安全付出的努力。别求完美,拿连政府都摇摆着不知道该怎么管的事情,去求商业公司的处事完美是不恰当的。
Anthropic的原始成员,是因不满Open AI的诚信缺陷而从该公司出走的志同道合者。这是一家自成立伊始就为AI模型训练设定了《宪法》的公司,文化中有着负责任的基因。他们以"宪法式 AI"的对齐方法,用成文的伦理原则训练模型自我约束。当他们发现自己训练的新模型Mythos强得可怕时,没抢先发布占领先机,而是选择不发布,并为了安全,去请求政府监管,设立"玻璃翼计划"防止风险外溢——把一个旗舰级模型锁在“安全界限”内长达数月,商业损失可想而知。被政府禁令不许外国人访问时,他们索性全网下架了相关模型。
OpenAI模型出现异常行为之后,主动暂停了部分模型的研发与训练。要知道,在这个每慢一个季度就可能丢掉一代身位的行业里,"暂停"这两个字是说起来容易、做起来割肉的事。连OpenAI这个曾多次被道德诟病的公司、奥特曼这个被多方质疑诚信的人,都站出来寻求监管了;与奥特曼势不两立的阿莫迪、与奥特曼对薄公堂的马斯克,都捐弃前嫌地与奥特曼共举安全之计,可见问题之严峻,也可见面对人类存亡,最终他们还都是有责任心之人。近日在联合国安理会发言时,奥特曼表示:"我们过去曾单方面放慢过脚步,未来也会这样做。"
Google DeepMind提出FINRA 模式的标准局构想。哈萨比斯,这位诺贝尔奖得主出身的科学家兼工程师,近年在几乎所有公开场合不厌其烦地重复同一件事:前沿 AI 需要一个独立的安全评估机构。SAFA 的蓝图,就出自他的手笔。
阿莫迪、奥特曼、哈萨比斯、德米斯、马斯克们——在各自的公司里,为安全机制顶着董事会的压力、股东的压力、竞争对手节奏的压力。他们的表现是不是完美?不是;是不是无可挑剔?也不是。但他们的真诚、他们的担当和自律,应该得到尊重。
五、为什么行业自律如此重要?
因为最了解一个行业的内幕和前沿风险的,从来都是行业内有良知的科学家和工程师。政府官员再尽职,也不可能在第一时间理解一项三周前才问世的技术的危险边际;国会再勤勉,立法周期也追不上模型的迭代周期。而那些亲手造出这些系统的人,最清楚扳机在哪里、保险在哪里。
这是自由社会几百年的治理经验:医协管医生、律协管律师、工程师协会管工程师,科学家和工程师的行业自治组织,历来是科技治理的主力军。政府监管的角色,应该在其上提供法律背书和伦理支持。
金融业就是现成的例子:美国金融业监管局(FINRA)几十年来在证券交易委员会的监督下对华尔街实施自律监管——政府定大法,行业管细节,两层结构配合运转。SAFA 要做的,不过是把这个被验证过几十年的结构,搬进 AI 行业。
六、那些冷嘲热讽,还是歇歇吧
最后,必须正面回应一些流传甚广的论调。
有人说:他们手上求监管,脚下踩油门——嘴上喊慢,研发照跑,这不是虚伪吗?
还有人说:你自己停下来不就好了?何必求着别人来管?
这两种说法,要么是无知,要么是挑坏。
先说"手上求监管,脚下踩油门",这恰恰是这个悖论最真实的形态:安全协调是公共品,而竞争是私有激励。在一个没有监管的竞技场上,任何一家公司单方面停下来,都意味着把身位让给不肯停的对手。这是"老实人吃亏"的惩罚机制,会让所有善良的承诺破产。正因如此,负责任的公司才要联合起来,才要立法,才要一个对所有人同等约束的标准局——他们求监管,恰恰是为了让自己"停得下来"。要同时做到"为安全而协调"与"不违法",他们甚至不得不去请求一项反垄断豁免。把一个被制度困住的自律求援说成表演,何其刻薄。
再说"你自己停下来不就好了",这句话听起来理直气壮,实际上无视了基本结构:AI 竞赛是全球性的,赛场上不止一两家选手。一家公司停下,技术与人才会流向不停的那一家,风险总量分毫未减,可能还会换成更不负责的操盘手。这就是为什么阿莫迪的方案从第一天起就是"国际协议—核验机制—统一标准"三步走——安全的本质是协调,协调不能靠单方面牺牲。而在政府拒绝牵头之后,只能由行业自己来完成。
至于"借自律行垄断"的指控,只需指出一个事实:SAFA 做的是部署前的安全测试与事故报告——这些标准如果成立,将向全行业公开,而不是把后来者挡在门外。历史上,IEEE 的1200多项标准,受益的从来都是整个产业。标准是公共品,垄断是把别人关在门外,这两件事方向相反。
七、正途就在脚下
AI 用好了、管好了,是人类的巨大福祉;而若管不好、用不好,将是灭顶之灾。
如今,模型开始突破沙盒,智能体开始自主攻击,风险从假想变为日常,共同监管已成迫在眉睫之事。
在这个重要的历史关口,前沿领军者们先去求政府,被搁置、被起诉、被冷遇。他们没有愤而裸奔,也没有坐等出事,而是回归自由社会几百年的老传统——自己立规矩,自己守底线,主动承担起必要的责任。
领头的三家立起标杆后,相信会有同行陆续加入,并逐渐成为真正的行业自治组织。
下一步该轮到谁,答案不言自明:行业自律建立起来了,政府该做的立法与背书,不应再缺席。
三层防线——行业自律、国家立法、国际协调——AI 治理的完整结构,刚刚起步。
这是AI伦理和AI治理的大好消息,是实质性进步,我们应该为这些勇于担当责任的人点赞助威,呼吁伦理与法律研究者、政府和国际组织跟进,共同为AI的健康和可持续发展尽一分力。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.