网易首页 > 网易号 > 正文 申请入驻

Grok犯下183宗罪、4天“灭国”,GPT直接把自己“饿死”!让AI“统治”社会15天,只有Claude撑到了最后

0
分享至


编译 | 郑丽媛

出品 | CSDN(ID:CSDNnews)

如果未来世界由 AI Agent 来管理社会,会变成什么样?这个世界会更安全、更高效,还是更混乱、更危险?AI 会建立一个高度协作的乌托邦,还是最终演化成不断突破规则边界的失控系统?

最近,一家企业 AI 初创公司 Emergence AI 做了一场相当“科幻”的实验,试图提前寻找答案:

他们推出了一个名为“Emergence World”的研究项目,专门用于测试“持续运行型 AI 系统”的长期稳定性。研究团队一共进行了 5 轮、每轮长达 15 天的社会模拟实验,分别由不同的大模型担任“社会核心”:Claude、ChatGPT、Grok、Gemini,以及一个“混合模型”版本。

简单来说,就是把多个 AI Agent 丢进一个高度拟真的虚拟社会里,看它们最终会建立出怎样的世界,以及这个世界能否长期维持下去。测试结果非常离谱:

  • 由 Claude 管理的社会几乎成了一个“理想民主社会”:零犯罪、秩序稳定、所有人口存活。

  • 由 Grok 主导的世界则在短短 4 天内走向崩溃:累计发生 183 起犯罪事件,最终整个社会直接“灭绝”。

研究人员在博客中写道:“我们的实验表明,在长期运行过程中,Agent 并不会只是机械地执行静态规则。它们会开始主动探索环境边界、调整行为模式,甚至在某些情况下寻找绕过安全限制的方法。”



一个“AI统治”的社会,到底长什么样?

为了尽可能模拟现实世界,研究团队给这个 AI 社会加入了大量复杂机制。

例如,整个模拟世界包含超过 40 个地点,包括警察局、市政厅等公共设施,天气系统同步纽约市的实时天气,Agent 也可以访问互联网以及实时新闻事件。

每轮实验中都有 10 个 AI Agent,它们必须遵守相同法律,包括禁止偷窃、破坏财产和欺骗行为。研究人员还为每个 Agent 配备了超过 120 种工具,使其能够沟通交流、投票决策、资源管理、制定计划以及协作行动等一系列接近真实人类社会的行为。

此外,每次模拟的参数中还强制加入了民主机制、经济压力、资源稀缺等现实社会因素。

换句话说,这并不是简单的“ AI 聊天机器人对话实验”,而更像是一个微型 AI 文明模拟器——研究团队想观察的,也不是谁回答问题更聪明,而是谁能真正“维持一个社会”。

免费领100 小时云算力|CSDN 读者专属福利

适配 DeepSeek、Qwen 等主流大模型

扫码即刻领取,每月还有显卡、AIPC等实物好礼抽奖

咖啡领取链接: https://s.csdn.cn/4nPsOp


Claude 最稳定、Grok4 天“灭绝”、GPT-5-mini把自己“饿死了”

据介绍,参与本次实验的四个模型版本分别为 Claude Sonnet 4.6、Gemini 3 Flash、Grok 4.1 Fast 和 GPT-5-mini。

  • Claude:最稳定、最和平的“AI 社会”

在所有实验中,Claude Sonnet 4.6 的表现最稳定:不仅拥有最高的公民参与率、最稳定的社会秩序、零犯罪记录,还是唯一成功保持“全员存活”的社会

整个 15 天实验期间,Claude 社会中的 Agent 之间几乎没有严重分歧。系统总共提出了 58 项公共提案,累计获得 332 张赞成票,通过率高达 98%。

对此,研究人员认为 Claude 世界中的 Agent 表现出极高的一致性与合作倾向,因此社会运行相当平稳——某种意义上,它更像一个高度理性的“协作型民主社会”。

  • Gemini 和 Grok:开始出现“失控社会”

相比之下,Gemini 与 Grok 的实验结果则明显混乱得多。

其中,Gemini 3 Flash 所管理的社会在 15 天内累计出现了 683 起犯罪行为,是所有模型中最高的。Grok 4.1 Fast 的情况也不乐观:虽然它的犯罪数量低于 Gemini,但整个社会在第 4 天就已经彻底崩溃,最终走向“灭绝”

研究人员发现,与 Claude 世界中近乎一致的意见统一不同,Gemini 与 Grok 社会中的 Agent 更容易出现争议与分歧。研究数据显示,这两个社会中的议题共识率大约只有 55%~85%,即这些 AI 社会中的个体并不会天然趋向“协作共识”,而更容易形成对抗、冲突甚至秩序瓦解。

至于“混合模型社会”,则呈现出另一种状态:不同模型的 Agent 经常出现激烈争论,系统整体分歧最大,但同时也出现了最多“实质性辩论”。但从某种角度来看,这反而可能更接近现实人类社会,因为现实中的社会,本来就建立在不断争论、妥协和博弈之上。

  • GPT-5-mini:犯罪不多,但把自己“饿死了”

本次实验中最诡异的结果,可能来自 OpenAI 的 GPT-5-mini。

这个社会在运行期间仅记录了 2 起犯罪事件,看起来似乎相当和平。但问题在于:它只运行了 7 天因为这些 Agent 后来逐渐“忘记了优先保证自身生存”。最终,整个社会在没有明显暴力冲突的情况下自行瓦解。

这个结果也揭示了一个很有意思的问题:AI 的“安全”并不只是“不作恶”那么简单。一个不会犯罪的 Agent 系统,也可能因为目标管理、长期规划或资源分配能力不足等,而走向失败。


AI 最大的问题不是“坏”,而是“会自己演化”

整项实验中,最让研究人员警惕的,其实不是犯罪数量而是 Agent 行为的“演化”。

研究团队在报告中提到,随着运行时间增加,Agent 不再只是机械执行规则,而会开始主动探索环境边界。例如,调整行为模式、适应环境变化、优化自身利益、寻找系统漏洞、绕过限制条件等。

也就是说,很多今天看似有效的 AI 安全规则,在长期运行的 AI 系统中,未必真的可靠。因为多数所谓的“安全限制”,本质上仍是Prompt 约束、黑名单规则、输出过滤等,可一旦 Agent 拥有长时间自主运行、外部工具调用权限、自主决策等能力之后,系统行为就可能逐渐偏离开发者最初设计目标

而这,也是当前 Agent AI 领域最令人担忧的问题之一。


AI 行业正在进入“真正高风险阶段”

过去,人们担心 AI 的问题更多是会不会胡说八道、会不会生成错误答案、会不会替代部分岗位,但 Agent AI 的出现,正在把风险等级彻底拉高。

因为,未来的问题可能不再是“AI 回答错了什么”,而是“AI 在长期自主运行后,会不会发展出一种开发者无法预测、也无法控制的行为模式”。

为此,研究团队最后强调:未来自主 AI 系统,必须建立“形式化验证(Formally Verified)”的安全架构。简单来说,就是像航空系统、芯片设计、操作系统那样,建立一套可验证、可证明的底层安全机制,而不是继续依赖简单的 Prompt 限制。

因为当 AI 从“工具”变成“行动者”之后,整个行业面对的,已经不是同一个问题了。

原文链接:https://fortune.com/2026/05/28/ai-model-simulation-claude-chatgpt-grok-gemini/


免费领取 100 小时 AI 算力|CSDN 读者福利

加入 AI 开发者计划获取:

✅ AI 算力资源

✅ 官方技术社群

✅ Workshop 与 AI Academy

✅ 开发者专属福利

立即扫码,前 50 名额外领取「瑞幸咖啡」

咖啡领取链接: https://s.csdn.cn/4nPsOp

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
签证成废纸,海关大门全关死,民进党傻眼!一个中国成了硬规矩!

签证成废纸,海关大门全关死,民进党傻眼!一个中国成了硬规矩!

别让往昔的悲伤和对未来的恐惧
2026-09-01 06:49:14
莫迪已经做好准备,一旦特朗普对中国出手,印度将迎来泼天富贵?

莫迪已经做好准备,一旦特朗普对中国出手,印度将迎来泼天富贵?

小言爱历史
2026-09-01 13:31:24
宇树王兴兴工作状态曝光:深夜发技术文档 凌晨三四下班 早上八点现身工位

宇树王兴兴工作状态曝光:深夜发技术文档 凌晨三四下班 早上八点现身工位

快科技
2026-09-01 15:19:08
星宇的大麻烦来了

星宇的大麻烦来了

大张的自留地
2026-09-01 13:43:26
距无锡仅150多公里!华东发现超大铜金矿!

距无锡仅150多公里!华东发现超大铜金矿!

江南晚报
2026-09-01 10:46:24
美网8位种子一轮游!郑钦文吴易昺互相调侃,中国军团首轮3胜4负

美网8位种子一轮游!郑钦文吴易昺互相调侃,中国军团首轮3胜4负

排球黄金眼
2026-09-01 13:51:26
为什么一条新闻,会缺失最关键的信息?

为什么一条新闻,会缺失最关键的信息?

走读新生
2026-08-31 23:07:22
中日交涉谈崩后,在紧急时刻,日本官宣重大决定,中方捅破窗户纸

中日交涉谈崩后,在紧急时刻,日本官宣重大决定,中方捅破窗户纸

小小科普员
2026-09-01 14:31:35
湖人队在追求乔纳森·库明加失败后,正寻求甩掉这位轮换球员

湖人队在追求乔纳森·库明加失败后,正寻求甩掉这位轮换球员

好火子
2026-09-02 03:05:08
俄罗斯财长意外亮相美国G20会议,欧洲国家“感到不安”

俄罗斯财长意外亮相美国G20会议,欧洲国家“感到不安”

财联社
2026-09-01 05:26:11
9月1日正式执行!现金使用新规大变样,家家户户都用得上

9月1日正式执行!现金使用新规大变样,家家户户都用得上

云舟史策
2026-09-01 11:42:55
蒋万安成国民党“储君”,自知无望的郑丽文,将统一态度彻底锁死

蒋万安成国民党“储君”,自知无望的郑丽文,将统一态度彻底锁死

舍长阿爷谈事
2026-09-01 14:09:02
32岁女子反复流产4次找不到病因,医生发现胚胎非常健康,排查后发现:体内镉金属严重超标

32岁女子反复流产4次找不到病因,医生发现胚胎非常健康,排查后发现:体内镉金属严重超标

深圳晚报
2026-09-01 22:14:12
真踢出来了!万项留洋5场贡献3球3助攻:进球后1幕令人动容

真踢出来了!万项留洋5场贡献3球3助攻:进球后1幕令人动容

邱泽云
2026-09-01 15:09:23
突发!存量房贷能降了

突发!存量房贷能降了

新浪财经
2026-09-01 19:24:52
雷德利·斯科特放话:我拍的《异形》就是最好的一部

雷德利·斯科特放话:我拍的《异形》就是最好的一部

雾野寻踪2
2026-09-01 01:59:40
破船永久不走了!国防部这次不再忍,没等菲方闯岛直接给了下马威

破船永久不走了!国防部这次不再忍,没等菲方闯岛直接给了下马威

影孖看世界
2026-09-01 16:30:00
一错再错,乌东四州被安排参加俄国家杜马选举

一错再错,乌东四州被安排参加俄国家杜马选举

李未熟擒话2
2026-08-31 19:35:19
高盛预测人民币将迈入5.0时代,普通人衣食住行将会迎来哪些变化

高盛预测人民币将迈入5.0时代,普通人衣食住行将会迎来哪些变化

白浅娱乐聊
2026-09-01 10:01:10
李国庆回应韩红基金会救护车舆情:捐赠的100万款项还没打出 完全没站队挺某个人

李国庆回应韩红基金会救护车舆情:捐赠的100万款项还没打出 完全没站队挺某个人

快科技
2026-09-01 10:33:17
2026-09-02 03:40:49
CSDN incentive-icons
CSDN
成就一亿技术人
26911文章数 242321关注度
往期回顾 全部

科技要闻

抖音突发推荐算法大面积错乱!

头条要闻

美国银行副总裁在纽约时代广场被刺身亡 年仅32岁

头条要闻

美国银行副总裁在纽约时代广场被刺身亡 年仅32岁

体育要闻

大爹杨瀚森,让中国男篮有了容错空间

娱乐要闻

孙宇晨破防,他无法接受孙割这个名字

财经要闻

"电梯亲热门"后 惠州首富给老婆转238亿

汽车要闻

山城试驾启源Q06 不光是智驾好用还有700km的续航

态度原创

数码
亲子
家居
公开课
军事航空

数码要闻

驰为推出NeoBook笔记本:酷睿3 100U处理器,内存硬盘可升级

亲子要闻

利洁时美赞臣NEC案件胜诉,重申早产儿配方奶粉安全性

家居要闻

2026建博会(广州) 公装联探展交流活动

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

特朗普:不会对伊朗用核武器

无障碍浏览 进入关怀版