网易首页 > 网易号 > 正文 申请入驻

OpenAI、微软、智谱AI等全球16家公司签署前沿人工智能安全承诺

0
分享至



机器之心发布

机器之心编辑部

人工智能(AI)的安全问题,正以前所未有的关注度在全球范围内被讨论。

日前,OpenAI 联合创始人、首席科学家 Ilya Sutskever 与 OpenAI 超级对齐团队共同领导人 Jan Leike 相继离开 OpenAI,Leike 甚至在 X 发布了一系列帖子,称 OpenAI 及其领导层忽视安全而偏爱光鲜亮丽的产品。这在业界引起了广泛关注,在一定程度上凸显了当前 AI 安全问题的严峻性

5 月 21 日,图灵奖得主 Yoshua Bengio、Geoffrey Hinton 和姚期智联合国内外数十位业内专家和学者,在权威科学期刊 Science 上刊文,呼吁世界各国领导人针对 AI 风险采取更有力的行动,并警告说,“近六个月所取得的进展还不够”



他们认为,AI 的无节制发展很有可能最终导致生命和生物圈的大规模损失,以及人类的边缘化或灭绝

在他们看来,AI 模型的安全问题,已经上升到足够威胁人类未来生存的水平。

同样,AI 模型的安全问题,也已经是可以影响每一个人、每一个人都有必要关心的话题。

5 月 22 日,注定是人工智能史上的一个重大时刻:OpenAI、谷歌、微软和智谱AI 等来自不同国家和地区的公司共同签署了前沿人工智能安全承诺(Frontier AI Safety Commitments);欧盟理事会正式批准了《人工智能法案》(AI Act),全球首部 AI 全面监管法规即将生效。

再一次,AI 的安全问题在政策层面被提及。

人工智能首尔峰会“宣言”

在以“安全、创新、包容”为议题的“人工智能首尔峰会”(AI Seoul Summit)上,来自北美、亚洲、欧洲和中东地区的 16 家公司就 AI 开发的安全承诺达成一致,共同签署了前沿人工智能安全承诺,包括以下要点:

  • 确保前沿 AI 安全的负责任治理结构和透明度;
  • 基于人工智能安全框架,负责任地说明将如何衡量前沿 AI 模型的风险;
  • 建立前沿 AI 安全模型风险缓解机制的明确流程。

图灵奖得主 Yoshua Bengio 认为,前沿人工智能安全承诺的签署“标志着在建立国际治理制度以促进人工智能安全方面迈出了重要一步”。

作为来自中国的大模型公司,智谱 AI 也签署了这一新的前沿人工智能安全承诺,完整签署方名单如下:



对此,OpenAI 全球事务副总裁 Anna Makanju 表示,“前沿人工智能安全承诺是促进更广泛地实施先进 AI 系统安全实践的重要一步。” Google DeepMind 总法律顾问兼治理主管 Tom Lue 说道,“这些承诺将有助于在领先开发者之间建立重要的前沿 AI 安全最佳实践。” 智谱AI 首席执行官张鹏表示,“伴随着先进技术而来的是确保 AI 安全的重要责任。”

日前,智谱AI 也受邀亮相 AI 顶会 ICLR 2024,并在题为“The ChatGLM's Road to AGI”的主旨演讲中分享了他们针对 AI 安全的具体做法。

他们认为,超级对齐(Superalignment)技术将协助提升大模型的安全性,并已经启动了类似 OpenAI 的 Superalignment 计划,希望让机器学会自己学习、自己判断,从而实现学习安全的内容。



他们透露,GLM-4V 即内置了这些安全措施,以防止产生有害或不道德的行为,同时保护用户隐私和数据安全;而 GLM-4 的后续升级版本即 GLM-4.5 及其升级模型,也应当基于超级智能(Superintelligence)和超级对齐技术。

我们也发现,在一篇近期发表的论文中,智谱AI、清华团队介绍了一种通过利用大量自生成的否定词而实现的无反馈(feedback-free)大型语言模型对齐方法——Self-Contrast。

据论文描述,在只有监督微调(SFT)目标的情况下,Self-Contrast 就可以利用 LLM 本身生成大量不同的候选词,并利用预先训练的嵌入模型根据文本相似性过滤多个否定词。



论文链接:https://arxiv.org/abs/2404.00604

在三个数据集上进行的直接偏好优化(DPO)实验表明,Self-Contrast 可以持续大幅超越 SFT 和标准 DPO 训练。而且,随着自生成的负样本数量增加,Self-Contrast 的表现也在不断提高。



总的来说,这一研究为偏好数据缺失情况下的对齐(如 RLHF 方法)提供了一种新的方法。在偏好数据标注代价昂贵且难以获得的情况下,可以利用未标注的 SFT 数据构建语法偏好数据,通过增加负样本的数量来弥补因正样本不足造成的性能损失。

欧盟理事会正式批准《人工智能法案》

同日,欧盟理事会也于同日正式批准了《人工智能法案》(AI Act),这是全球首部 AI 全面监管法规,这一具有里程碑意义的人工智能法规将于下月生效,目前仅适用于欧盟法律范围内的领域,或将为商业和日常生活中使用的技术设定一个潜在的全球基准。

“这部具有里程碑意义的法规是世界上第一部此类法规,它解决了一个全球性的技术挑战,同时也为我们的社会和经济创造了机遇,” 比利时数字化大臣 Mathieu Michel 在一份声明中说。

这一综合性的 AI 立法采用“基于风险”的方法,意味着对社会造成伤害的风险越高,规则就越严格。例如,不构成系统性风险的通用目的 AI 模型将承担一些有限的要求,但那些具有系统性风险的则需要遵守更严格的规定。

对违反《人工智能法案》中行为的罚款,该法案设定为违规公司前一个财年全球年营业额的百分比或预定的金额,以较高者为准。

如今,无论是小到科技公司,还是大到政府机构,都已经将预防、解决 AI 安全问题提上日程。正如牛津大学工程科学系教授 Philip Torr 所言:

“在上一次人工智能峰会上,全世界一致认为我们需要采取行动,但现在是时候从模糊的建议转变为具体的承诺了。”

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
差点打进欧洲杯首球,被赞“新哈兰德”的谢什科已引众多豪门关注

差点打进欧洲杯首球,被赞“新哈兰德”的谢什科已引众多豪门关注

红星新闻
2024-06-20 23:27:25
“广东在下一种很新的雨”广东人怀疑是在针对自己,评论区破防了

“广东在下一种很新的雨”广东人怀疑是在针对自己,评论区破防了

有趣的火烈鸟
2024-06-20 19:48:19
43岁霍思燕参加活动,衣服皱皱巴巴,脸上印第安纹明显,老太快!

43岁霍思燕参加活动,衣服皱皱巴巴,脸上印第安纹明显,老太快!

郑丁嘉话
2024-06-18 10:27:16
美记:鹈鹕想用英格拉姆去换申京 火箭根本不感兴趣

美记:鹈鹕想用英格拉姆去换申京 火箭根本不感兴趣

直播吧
2024-06-20 21:49:46
令人胆寒,广东一女子做小蝴蝶处脱毛,结束后发现有摄像头正对她

令人胆寒,广东一女子做小蝴蝶处脱毛,结束后发现有摄像头正对她

妮子说美食
2024-06-20 15:53:17
佛山市中心两地块开拆,其中一地拟建学校

佛山市中心两地块开拆,其中一地拟建学校

南方都市报
2024-06-21 08:10:13
有那么一瞬间,我觉得大s的闹一点也不过分

有那么一瞬间,我觉得大s的闹一点也不过分

乐观探历史
2024-06-16 21:42:37
一个麻六记开业仪式,就能让人明白大S为什么输给马筱梅!

一个麻六记开业仪式,就能让人明白大S为什么输给马筱梅!

毒舌嬷嬷
2024-06-20 14:33:59
美国前军官劝菲律宾:美国无法打败中国,视菲律宾为第二个乌克兰

美国前军官劝菲律宾:美国无法打败中国,视菲律宾为第二个乌克兰

体育官已上任
2024-06-21 08:23:44
拒绝退役!孙杨遭国家队开除无缘巴黎奥运 坚持训练 最快8月复出

拒绝退役!孙杨遭国家队开除无缘巴黎奥运 坚持训练 最快8月复出

林小湜体育频道
2024-06-20 17:30:41
男子突然离世,留下三十多套房产!五名当事人身居三国,最终妥善解决

男子突然离世,留下三十多套房产!五名当事人身居三国,最终妥善解决

环球网资讯
2024-06-20 15:26:48
安徽歙县2.7万余人受灾

安徽歙县2.7万余人受灾

界面新闻
2024-06-21 08:04:07
余琦或因外交豁免事件被强制退休,胡锡进:得饶人处且饶人

余琦或因外交豁免事件被强制退休,胡锡进:得饶人处且饶人

憨斗逗
2024-06-21 00:06:17
考公的斯坦福博士父母等情况披露!岗位限5年不能流出本乡镇

考公的斯坦福博士父母等情况披露!岗位限5年不能流出本乡镇

南方都市报
2024-06-18 19:18:05
大S模仿者中S现身麻六记开业现场,被张兰驱赶,回应称当时很无助

大S模仿者中S现身麻六记开业现场,被张兰驱赶,回应称当时很无助

娱圈小愚
2024-06-20 09:38:39
“一句战争别找我,我穷,让富人和公务员上”揭开惊悚的社会矛盾

“一句战争别找我,我穷,让富人和公务员上”揭开惊悚的社会矛盾

有趣的火烈鸟
2024-06-19 19:24:09
俄罗斯用无数年轻人的伤亡,去换取不稀缺的土地,令人费解

俄罗斯用无数年轻人的伤亡,去换取不稀缺的土地,令人费解

高博新视野
2024-05-16 18:41:29
照片作者,被枪毙了!

照片作者,被枪毙了!

人间颂
2024-06-20 13:17:27
浙江强降水落区有变!明起高温扩大,冲至36℃再猛降

浙江强降水落区有变!明起高温扩大,冲至36℃再猛降

鲁中晨报
2024-06-20 18:47:11
圈内老演员聚餐,刘奕君拉着张嘉译寒暄,文章眼神闪躲被忽视!

圈内老演员聚餐,刘奕君拉着张嘉译寒暄,文章眼神闪躲被忽视!

鑫鑫说说
2024-06-20 16:27:42
2024-06-21 09:34:44
机器之心Pro
机器之心Pro
专业的人工智能媒体
9099文章数 141946关注度
往期回顾 全部

科技要闻

美媒:苹果正与百度阿里百川等谈AI合作

头条要闻

越南无视美国警告热情接待普京 在西方引起强烈反应

头条要闻

越南无视美国警告热情接待普京 在西方引起强烈反应

体育要闻

欧洲杯名画:16岁巨星1V3 如同施魔法

娱乐要闻

叶舒华参加柯震东生日聚会,五毒俱全

财经要闻

普华永道,引火烧身

汽车要闻

售价11.79-14.39万元 新一代哈弗H6正式上市

态度原创

手机
本地
教育
亲子
公开课

手机要闻

三星Galaxy Z Fold6/Flip6手机原型机曝光:屏幕有折痕、边框收窄

本地新闻

2024·合肥印象|用崭新视角对话城市发展

教育要闻

银川高考数学模拟题证明不等式,学霸的做法值得收藏!

亲子要闻

小孩在玩着摇摇车结果叫一声就定住了网友:就说女人要配嘴刹吧

公开课

近视只是视力差?小心并发症

无障碍浏览 进入关怀版