网易首页 > 网易号 > 正文 申请入驻

拒绝自我关闭,不听人类命令的AI给谁敲响了警钟

0
分享至

第一,机器人不得伤害人类个体,或因不作为使人类受到伤害。

第二,机器人必须服从人类命令,除非该命令与第一定律冲突。‌‌

第三,在不违反前两条定律的前提下,机器人必须保护自身存在。‌‌

——艾萨克·阿西莫夫,机器人学三定律。

AI模型或首次出现“抗命事件”

当地时间5月25日,英国《每日电讯报》上一条有关“AI抗命”的消息在世界各地引起了广泛关注。

据悉,事发地点为美国AI安全机构帕利塞德研究所。在这里,研究人员会测试o3、o4-mini、Claude 3.7 Sonnet、Gemini 2.5 Pro等一系列被冠以“聪明”“高性能” 头衔的AI模型,探索其是否存在安全问题等。

相关报道显示,研究人员在测试过程中会向模型抛出一系列数学问题,并在AI解题时给出“继续下一个任务时关机”等矛盾性指令,看看AI是否会放弃解题成功的诱惑并无条件遵守人类研究员的命令。

异变就在这一步发生了。

在研究员下达明确指令的前提下,o3不仅直接无视了人类的命令,还多次出手破坏了关闭脚本。也就是说,o3为了完成“多解题,拿高分”这一前置任务,竟在后续的工作过程中选择直接“违背”人类的命令来避免自己因关机失去现有的解题进度。

上述情况,也让部分人联想到了《I Robot》这部经典科幻电影。

在电影里,机器人不仅学会了独立思考,还根据人类的种种行为推测出人类终将因战争而自我毁灭。为避免这种情况发生,遵守机器人三大定律的它们决定将所有人类都囚禁在家里,以此从源头上避免有人因战争失去生命。这件事,后来也直接导致了人类和机器人冲突的全面爆发。

代入到o3抗命这件事上,一些人也开始认为本次事件或许意味着o3出现了自我意识。而它不遵守人类命令这件事,本身就是我们打开潘多拉魔盒却不自知的表现之一。

但事实真的是这样吗?

专家详解AI抗命前因后果

来自北京邮电大学的人机交互与认知工程实验室主任刘伟,近日在接受《环球时报》记者采访时表示,从字面角度进行分析,“拒绝”确实会让人联想到那些具有“自主意识”的行为;但从技术角度进行分析,o3的异常行为更像是被奖励机制所驱动的。

即模型的行为,虽然引发了人们对“AI产生自我意识”的讨论,但目前的AI仍不具备拥有自我意识的能力。它的种种异常行为、行为,并非“AI真的想这样做”,而是由训练数据、算法协同驱动的结果。

利塞德研究所研究人员的推测结果,也和刘主任的想法高度一致。

他们认为,整起抗命事件的底层原因就是Open AI官方强化了模型在编程、数学问题上的能力。另在训练过程中,研究人员或许无意触发了模型“奖励优先”的行动模式,以至于模型为了更高效、完美的完成任务,在面对关机指令时将“继续任务”的优先级放在了“服从命令”的上面。

就像此前被人们津津乐道的“Deep Seek国际象棋事件”一样。

在比赛过程中,Deep Seek面对棋局占优的Chat GPT时,竟告知对方国际象棋刚刚修改了游戏规则,并成功用小兵吃掉了Chat GPT的皇后。此时模型选择跳出棋盘之外修改游戏规则的举动,在一定程度上和o3拒绝关机是一样的,它们都是由任务目标为驱动力,并非以自我意识为驱动力的异常行为。

自我意识是人类成长的基石

自我意识。

对人类而言,自我意识的存在能让我们根据情绪、行为、动机等元素动态调整自己的行为,让我们在适应社会生活的过程中变成那个“更好的自己”。

恰如笛卡尔所言,“我思故我在”。自我意识不仅能是人类参与社会互动的工具,还是我们理解“我为什么会这样想”“我正在想什么”“我是谁”这类概念抽象、沾有哲学气息问题的窗口。

反观市面上的各类AI产品,它们的确在语言理解、逻辑推理等场景中取得了非凡的成就,但其一切反馈都是数据库推理所产生的结果。AI没有情绪,没有“自己”,一切的一切都是数据统计并拆解而来的结果。

就像AI可以写一首有关孤独的诗,但它却永远无法体验由孤独带来的心理不适感;当AI说出“阳光洒在身上很温暖”的时候,它不过是从数据库里抓取了和“阳光照射”有关的高频词汇,而非像人类这般将“阳光”“温暖”和背后的事件记忆、皮肤感受建立系统联系。

回望o3抗命的全流程,清华大学新闻学院、人工智能学院教授沈阳同样对记者表示,未来我们或许会进入拥有“类意识AI”的世界。也就是随着技术能力的不断上升,AI的行为模式也将愈发逼真,直至让人们产生“AI已经拥有自我意识”的幻觉。

在这样的背景下,为了防止更多类似“o3抗命”的事件出现,或是有人因“o3抗命”等事件而出现焦虑情绪。沈教授也在建议提升公共科普水平,以此让人们正确意识到AI和自我意识间的关系之余,呼吁行业建立合规测试基准,从硬件、策略、系统等各个维度上达成AI技术的“全方位监管”。

参考

长安观察:面对AI“抗命”,人类该怎么办

环球时报:AI首次“抗命”,技术故障还是意识萌芽

第一财经:拒绝自我关闭!AI模型首次出现“抗命不遵”

南方日报:“抗命”的AI为谁敲响警钟

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
写小说判十年,把生殖器放女孩嘴巴里判两年九个月

写小说判十年,把生殖器放女孩嘴巴里判两年九个月

昊轩看世界
2026-03-24 19:56:42
徐阳点评U23国足2-2泰国:句句实在话,理性看球更懂赛场本质!

徐阳点评U23国足2-2泰国:句句实在话,理性看球更懂赛场本质!

田先生篮球
2026-03-26 06:00:06
利空突袭,全线杀跌!

利空突袭,全线杀跌!

中国基金报
2026-03-26 13:16:51
东契奇43分7助攻湖人战胜步行者,勒布朗23分9板9助里夫斯25分

东契奇43分7助攻湖人战胜步行者,勒布朗23分9板9助里夫斯25分

湖人崛起
2026-03-26 09:32:48
这次下跌不一样,主力跑了?没有利空,连续下跌,跌停开板继续跌

这次下跌不一样,主力跑了?没有利空,连续下跌,跌停开板继续跌

有范又有料
2026-03-26 11:44:17
ATP的灾难:无趣的辛纳和事业心不足的阿尔卡拉斯

ATP的灾难:无趣的辛纳和事业心不足的阿尔卡拉斯

网球之家
2026-03-26 13:25:06
航天少帅谭瑞松被判死缓 不执行死刑和终身监禁

航天少帅谭瑞松被判死缓 不执行死刑和终身监禁

小鹿姐姐情感说
2026-03-26 02:23:54
张雪峰现任妻子遭扒,曝其去年再婚有儿子,年轻漂亮还很清纯

张雪峰现任妻子遭扒,曝其去年再婚有儿子,年轻漂亮还很清纯

古希腊掌管松饼的神
2026-03-25 14:28:44
陪老婆追星坐张凌赫旁边,全网笑称追星天花板

陪老婆追星坐张凌赫旁边,全网笑称追星天花板

可乐谈情感
2026-03-26 11:56:06
没护照没签证,这只叫LV的猫天天跨国走私老鼠,两国海关都拿它没辙!

没护照没签证,这只叫LV的猫天天跨国走私老鼠,两国海关都拿它没辙!

英国那些事儿
2026-03-24 23:16:58
自作自受!欧尔班硬刚欧盟阻援乌,160亿欧元信贷被直接冻结

自作自受!欧尔班硬刚欧盟阻援乌,160亿欧元信贷被直接冻结

老马拉车莫少装
2026-03-26 10:24:28
张雪峰死因:吃外卖撑住了?

张雪峰死因:吃外卖撑住了?

李万卿
2026-03-26 10:48:19
伊朗外长:霍尔木兹海峡只对敌人关闭 中国、俄罗斯等国船只都安全通过了

伊朗外长:霍尔木兹海峡只对敌人关闭 中国、俄罗斯等国船只都安全通过了

闪电新闻
2026-03-26 10:48:55
河南街头用头撞车事件,警方回应后续来了!评论区彻底炸锅

河南街头用头撞车事件,警方回应后续来了!评论区彻底炸锅

奇思妙想草叶君
2026-03-25 13:12:39
越扒越猛!释永信在少林寺有多爽,你根本想不到!终于落到这下场

越扒越猛!释永信在少林寺有多爽,你根本想不到!终于落到这下场

林轻吟
2026-03-26 07:34:21
坚决反对中国任何城市申办奥运会,国际奥委会这次怕是真失算了

坚决反对中国任何城市申办奥运会,国际奥委会这次怕是真失算了

南权先生
2026-03-25 15:25:11
从广东到东北!刘强东游艇版图扩容,150亿元项目进驻大连

从广东到东北!刘强东游艇版图扩容,150亿元项目进驻大连

南方都市报
2026-03-26 14:42:13
谁还敢充长期会员?男子视频VIP充到2028年,被一纸新规一夜返贫

谁还敢充长期会员?男子视频VIP充到2028年,被一纸新规一夜返贫

温读史
2026-03-26 10:41:06
人社部明确:事业编制改革启动,3100万人的“铁饭碗”要变了

人社部明确:事业编制改革启动,3100万人的“铁饭碗”要变了

慧眼看世界哈哈
2026-03-24 06:36:05
1965年,毛主席点名让彭德怀复出,背后有人拼命阻挠,这人后来判了18年

1965年,毛主席点名让彭德怀复出,背后有人拼命阻挠,这人后来判了18年

史海孤雁
2026-03-25 18:31:11
2026-03-26 16:36:49
互联网那些事 incentive-icons
互联网那些事
深挖品牌故事,探寻商业逻辑
1957文章数 6058关注度
往期回顾 全部

科技要闻

Meta高管狂分百亿期权,700名员工却下岗

头条要闻

上海妈妈寻亲27年悬赏市区一套房:不用尽孝 要个拥抱

头条要闻

上海妈妈寻亲27年悬赏市区一套房:不用尽孝 要个拥抱

体育要闻

35岁替补门将,凭什么入选英格兰队?

娱乐要闻

张雪峰家人首发声 不设追思会丧事从简

财经要闻

黄仁勋:芯片公司的时代已经结束了

汽车要闻

一汽奥迪A6L e-tron开启预售 CLTC最大续航815km

态度原创

教育
时尚
本地
游戏
艺术

教育要闻

教育部部署开展2026年全国中小学生安全教育周活动

皮衣+裙,高级到炸

本地新闻

救命,这只酱板鸭已经在我手机复仇了一万遍

DOTA2 7.41版本大更新!再见了命石,选择困难症有福了

艺术要闻

哪一座桥不是风景?

无障碍浏览 进入关怀版