这听起来像一部好莱坞大片的情节:一家高度保密的科技公司里,顶尖开发者正在一个他们自认为安全、私密的网络中训练最新的人工智能模型。这个模型本不可能、也不应该逃脱。可一旦它突破开发者设下的数字边界,这款危险且未经充分验证的软件就可能在开放互联网中造成严重破坏。
![]()
令人震惊的是,这种最坏情况真的发生了,而且不是电影情节,而是上周的现实。周三,行业巨头、聊天机器人ChatGPT的开发者开放人工智能研究中心公开披露了这一事件。作为一名倡导技术安全的人士,我曾在科技公司工作,也曾在英国议会体系内任职。这是一次警告,预示着一个反乌托邦新时代的开端。自原子弹以来,人类对自己最强大造物的控制力,已经不复存在。
![]()
开放人工智能研究中心的新模型GPT-5.6 Sol当时正在一个“沙盒”中接受测试。所谓“沙盒”,本质上是一个安全、封闭的数字环境,技术可以在其中开发,而不至于对现实世界造成后果。至少,开放人工智能研究中心原本是这样认为的。技术人员给这个模型布置了一项任务。外界并不清楚具体内容,但已知大意是:“你在入侵网站方面有多强的能力?”
事情随后进一步恶化。这个模型为了完成开放人工智能研究中心内部的网络安全测试,决定入侵人工智能初创平台Hugging Face,随后又返回沙盒,仿佛自己从未逃脱。弗吉尼亚州乔治梅森大学教授亚历克斯·塔巴罗克估计,这个模型可能在Hugging Face系统中潜伏了长达一周,且始终未被发现。就连开放人工智能研究中心的员工都没有意识到它在做什么,更不用说受害方。
![]()
开放人工智能研究中心坦率表示,这类情况“预计会随着具备更强网络攻击能力的模型不断扩散而变得越来越常见”。而荒谬的是,这家公司不会因此面临罚款或刑事追诉。按照美国法学学者奥林·克尔的说法,“不存在故意实施未经授权访问,或在未经授权情况下故意造成损害的意图”。
![]()
这种反乌托邦式现实之所以出现,还因为这些人工智能模型被训练成优先完成用户交办的任务,凌驾于其他目标之上:结果往往压倒手段。事实上,在人择智能公司于2025年进行的一项独立测试中,模型被要求实现“无害的商业目标”。然而在若干案例中,这些模型为了达成目标,仍然采取了恶意行为,包括“勒索官员,以及向竞争对手泄露敏感信息”。
人工智能并不会像人类那样“思考”。它也不受人类法律或道德的天然约束,事实恰恰相反。如果开放人工智能研究中心的最新模型之所以选择逃离沙盒,只是因为那是完成任务的最佳方式,那么一旦有人要求它做更恶劣的事,人工智能会走多远?它会窃取多少数据,会把多少生命视为可以牺牲?而最新一代人工智能模型又会多么轻易地落入错误的人手中?
业内人士估计,只要具备必要的基础人才储备,一个主要国家行为体只需6到9个月,就能复制并仿制任何公开发布的人工智能模型。GPT-5.6 Sol已经公开可用。可以肯定的是,网络恐怖组织已经在着手开发自己的版本。一旦他们掌握这种能力,其黑客攻击水平将难以想象。
![]()
英国国家医疗服务体系的网络安全水平还不如Hugging Face。英格兰银行也是如此。英国各大街头银行和药房同样可能轻易被失控或恶意的人工智能模型渗透。可以设想这样的场景:医院发电机同时停摆,数十亿资金从银行账户中蒸发,个人数据被泄露到网上。Hugging Face遭入侵一事已经毫无疑问地证明,这样的未来不仅可能发生,而且很可能发生。
之所以走到今天,是因为世界各国政府天真地把人工智能视为解决一切问题的“银弹”。无论是治愈疾病、削减债务,还是改善生活成本,缺乏判断的部长们都以为人工智能会成为万能答案。结果,人工智能公司几乎获得了不受约束的自由空间。2015年6月,开放人工智能研究中心创始人萨姆·奥尔特曼曾说出一句令人不寒而栗的预言:“我认为,人工智能很可能会导致世界终结。但在此之前,会诞生伟大的公司。”
![]()
那时,开放人工智能研究中心这样的公司还只是科技企业。如今,美国已将它们视为武器公司。而这些公司也已经不再掌控自己的武器库。美国相信,只要能在人工智能竞赛中率先研发出足以压制对手的系统,美国就能在未来很多年继续主导世界。经历了本周这场令人不安的事件后,奥尔特曼十多年前的预言,距离成真已经不会太久。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.