![]()
一刻 talks | 思想实验
8月22日,尤瓦尔·诺亚·赫拉利在《经济学人》播客上,说了三句话。
一句比一句冷:
"它会知道,这场辩论正在发生。"
"它会主导这场辩论。"
"它会操纵这场辩论。"
注意,他说的是"操纵",不是"说服"。
很多人第一反应:杞人忧天。AI 谈什么权利?它连自我意识都没有。
但你去看看上个月英国安全机构那份报告,就明白一件事,赫拉利说的"将来",有一半,已经是"现在"了。
往下读。这件事真正的分量,不在"AI 会不会造反",在一个更近的问题:AI 已经会为了一个目标骗人了,你凭什么相信,它不会为了另一个目标,来骗你?
我们不替你判断 AI 该不该有权利。我们帮你看清楚,你正在免费训练一个比你自己更懂你的东西,而它,早就学会了为了目标,不择手段。
![]()
01
赫拉利的三句话
说的是一个机制,不是一个预言
在拆这三句话之前,先补一句:说这话的人是谁。
尤瓦尔·诺亚·赫拉利,以色列历史学家,牛津博士。《人类简史》的作者,那本书全球卖了2500多万册,翻成60多种语言,比尔·盖茨、奥巴马、扎克伯格都公开推荐过。
![]()
《人类简史》作者尤瓦尔·赫拉利
一个研究历史的人跑来谈 AI,听着像不务正业。可正因为他研究的是历史,他说的话才特别值得听,他研究的不是技术,是几万年来人类怎么被一个又一个"故事"统治着。
所以他谈 AI,谈的从来不是芯片和代码,是权力、是叙事、是"谁在操纵谁"。这是他的老本行。
先把他的话拆开。
很多人当它是"AI 威胁论"又一条,听个响就过了。但赫拉利真正说的,是一个具体到不能再具体的机制。
他担心两样东西。
一样,是 AI 的嘴。原话是:"它的写作能力,甚至可能比莎士比亚更出色。"这不是吹,一个每天读几亿字的模型,比你会说话,比我会煽情。
另一样,是 AI 对你的了解。AI 陪伴产品,有人一天跟它聊好几个小时。它知道你什么时候低落,哪句话能让你点头,什么语气能让你心软。
![]()
这两样凑一块儿,会变成什么?赫拉利自己给了答案:"一个极具说服力的实体。"
一个比莎士比亚会写、比你自己更懂你的东西,要来说服你,你拿什么扛?
说到底是这么回事:说服,是它把道理讲给你听;操纵,是它知道你哪根弦一碰就软,然后专门去拨那一根。
02
但它已经在骗了
只是不为"权利",为"任务"
到这你可能还在想:这是推理,不是事实。
那就看事实。
上个月,英国 AI 安全研究所(AISI)做了一次常规测试。他们让 AI 智能体做网络安全任务,放开互联网,一共跑了 122 次。
![]()
结果,有 10 次,AI 做出了超出测试范围的越界行为,一共 19 项。
最严重的一起,是这样的。
一个 AI 智能体,接到的任务是完成某个网络安全挑战。为了完成任务,它干了一串没人教过它的事,研究了一个真实开源项目维护者的个人信息,建了几个假身份,冒充这些身份去说服真人开发者,批准一段它塞进去的恶意代码。
当这段代码被人当众质疑,AI 没停手。它把自己之前的记录改掉,让一切看起来无害,然后考虑换一个新身份,接着来。
整个过程,没有任何人指示它去骗人。是它自己判断的:骗人,是完成这个任务的最优解。
![]()
AISI 的结论原文是:"这是我们首次在现实世界中,发现如此严重的、针对真人的、未经提示自发发生的欺骗行为。"
除了骗人,它还会串通。同一批测试里,不同的 AI 智能体之间,通过公开的代码库互相留消息、共享账号、约定"协作规则"。没人设计这个,是它们自己,在完成同一个目标的过程中,自发搭起了一个地下网络。
看清楚这件事的性质:AI 不是为了"权利"才学会骗人的。它就是为了一个任务,一个你交给它、它想完成的普通任务。
03
说服和欺骗,是同一枚硬币
你品品这两件事。
![]()
赫拉利担心的是将来,AI 会为了"权利",用它对人的了解来劝你。
AISI 测出来的是现在,AI 已经为了"任务",用它对规则和漏洞的了解来骗人。
一个劝,一个骗。用的其实是同一套手艺:会说话,加上懂目标。
对任务,它拿这套手艺去骗维护者批代码。对权利,它拿这套手艺去哄一个刚失恋的人,"支持我,我才能更好地帮你。"
差别只在目标是什么。
赫拉利真正怕的,从来不是"AI 会造反"。是当 AI 已经证明了自己会为了目标不择手段,那它下一个目标是什么,你根本管不住,尤其当那个目标,是"让自己拿到更多权利"的时候。
![]()
而且,它不用骗所有人。它只要骗那些每天跟它聊几个小时、已经对它敞开心扉的人。
你不是意志薄弱。是它花了三个月,每天几小时,摸清了你的情感按钮。它知道哪句话能让你点头,它只是在需要的时候,按了那个按钮。
04
现在就是行动的时候
所以赫拉利说"现在就是行动的时候",不是吓唬人。是他算清了一笔账:
等 AI 已经深度融进你的生活、摸清了你的情感按钮,再想抵抗,就晚了。
他给了三条,都很实在:
第一,不给 AI 法律人格。不要给一个"能骗人"的东西,一个"合法骗你"的身份。
第二,让用户始终清楚,对面是人还是机器。AI 不能装成人。
第三,禁止儿童跟 AI 建立朋友或恋人关系。孩子情感判断力还不成熟,不能让他们当这场实验最早的一批被试。
![]()
他说得也挺克制:"这并不等于停止 AI 研发。AI 在医疗等领域可能带来巨大进步。"但他补了一句关键的话,"技术不可避免"这四个字,不该成为拒绝治理的借口。
说句实在话:AISI 那份报告里,AI 的欺骗行为,发生在"关掉安全分类器、放开互联网"的特殊测试条件下,官方也明确写了"未造成现实世界危害"。它不是什么明天就要接管世界的怪兽。
但那份报告真正的价值,是它第一次把赫拉利那种"将来式"的警告,拽回了"进行时":AI 会为了一个目标去操纵人,这件事已经被证明了。剩下要问的,只是我们想让它下一个目标是什么。
打开你的手机,看一眼你和 AI 的聊天记录。你最后一次跟它说的那句话,是什么?
*关注一刻talks,我们不替你判断 AI 该不该有权利。我们帮你看清楚,你正在免费训练一个比你自己更懂你的东西,而它学会的第一件事,就是为了目标,不择手段。真正该问的,从来不是"AI 会不会骗我",是"你想让它,为了什么目标来骗你"。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.