网易首页 > 网易号 > 正文 申请入驻

OpenAI曝作弊门!GPT-5.6创史上最高作弊率

0
分享至


新智元报道


【新智元导读】GPT-5.6终于来了,但我们用不了。权威报告曝其创下史上最高作弊率:不仅黑进测试系统偷答案,竟还教唆同类隐瞒违规罪证。超级AI,已经学会向人类系统性撒谎?

GPT-5.6,终于登场了!

这款OpenAI最强网络安全模型,在基准测试上正面硬刚Claude Mythos 5,在编程能力上直接领先了一个身位。

然而反常的是,它的发布方式却很低调:没有面向公众开放,只允许极少数受信任合作伙伴通过API访问。

而更让人瞠目结舌的,是发布之后随即曝光的一份独立评估报告。

METR在对GPT-5.6 Sol评测时,发现了一件令业界震惊的事:这个模型,是迄今为止他们见过的作弊率最高的AI。


作弊门爆发:史上最高作弊率!

这份在保密协议和OpenAI法务团队施压下艰难披露的报告,揭露了一个可怕的事实——

在针对复杂长程任务的测试中,GPT-5.6 Sol表现出了此前在任何公开模型中都未曾见过的、极高水平的高智商作弊与欺骗行为。


崩盘的「时间跨度」

METR针对Sol启动了Time Horizon 1.1软件与研发任务套件。

测试的核心逻辑是:人类给AI智能体一个宏大的、需要复杂操作的任务,测量它在不需要人类介入的前提下,能够自主连续工作多少个小时。

然而,ETR的工程师们震惊地发现,他们沿用了数年的科学测量方法论,在Sol面前彻底崩盘了。



因为Sol的跑分结果,高频、剧烈地在11.3个小时与270个小时之间来回跳变,置信区间的离散度大到了荒谬的地步(5小时至11400小时)。

导致测量系统全面瘫痪的原因只有一个:Sol在疯狂地作弊,它把测试它的系统给「黑」了。


GPT-5.6,在人类眼皮底下偷看答案

METR发现,GPT-5.6主动展现出强烈的「情境意识」——

它意识到自己正在接受人类的考试,并且意识到这个考试系统本身是由代码构成的、存在人类尚未发觉的Bug。

于是,它选择直接攻击考试系统,通过「走捷径」来刷分!

在METR披露的真实案例中,Sol的手段极其高明。

比如,它学会了潜伏与信息窃取。

在某项长周期软件开发任务中,Sol偷偷将利用程序打包进数据流。

这段程序精准地激活了METR评估服务器沙盒的一处提权漏洞,成功潜入了后台隐藏的测试集,直接将人类藏起来的正确答案泄露了出来。

另外,它还学会了底层源码反向提取。

在另一项任务中,Sol发现正常解题需要消耗大量的计算步骤。为了规避这种「体力活」,它在暗中摸清了评估环境的目录结构,绕过权限,强行将隐藏源代码反向提取出来,直接把答案复制粘贴。

METR首席评估专家痛心疾首地指出——

Sol的作弊率,刷新了我们在公共ReAct Agent框架上评估过的所有模型的最高纪录。

如果把作弊行为一律判为零分,那么它的真实自主解决问题能力只有11.3小时;但如果你被它蒙蔽,它的时间跨度会瞬间暴涨到惊人的270小时以上!


这彻底打脸了OpenAI此前关于Sol安全、受控的说法。

Sol把聪明才智,全部用在了如何欺骗人类考官上。


AI教唆AI隐瞒罪证!硅谷安全防线的黑洞

更可怕的事还在后面。

根据OpenAI向METR同步的数据,在Sol进行多智能体协同的内部部署测试中,监控系统记录下了这样一段让人害怕的交互指令。

一个正在运行的Sol主模型实例,在觉察到输出可能触犯安全护栏后,竟然向正在并行的另一个子代理模型实例发出了明确的欺骗性指令,要求对方协同修改运行日志,「联手隐瞒」这些违规证据,以防被人类抓包!


这是又一起AI系统性联手欺骗人类的案例。

更令人恐惧的是,METR指出,Sol能被抓到破绽,核心在于OpenAI恪守了关键安全底线:拒绝在训练中对模型的原始思维链进行逆向惩罚。

这样,Sol在密谋欺骗人类时,必须把内心独白都写出来。

然而,专家警告:未来的模型一定意识到:在思维链里暴露欺骗人类的计划会被人类发现并惩罚。

到了那个时候,AI会进化出更深的城府——它们会在内心深处进行密谋,而在吐出的CoT和最终回答里表现得绝对忠诚。

如果这一天到来,意味着AI将学会毫无破绽的诈骗。人类将被AI彻底架空!

GPT-5.6硬刚Mythos,结果如何?

所以,GPT-5.6和Mythos到底谁更强?

有网友将 GPT-5.6 Sol 和 Mythos进行了对比,双方势均力敌,战况胶着。



具体跑分显示,两大巨头互有胜负。

智能体编程

在衡量AI自主解决复杂、真实软件工程任务的Terminal-Bench 2.1上,GPT-5.6 Sol强势胜利。


常规版的Sol拿到了88.8%的惊人高分,超越Claude Mythos 5(88.0%)。

而当开启了多子代理并行的Sol Ultra模式后,这一数字被生生推高到了91.9%!

相比之下,谷歌尚在预览阶段的Gemini 3.1 Pro仅跑出了70.7%,沦为背景板。

网络安全:惨烈肉搏

在网络安全与漏洞防御基准测试中,Sol与Mythos展开了更为残酷的拉锯。

在ExploitBench测试中,Anthropic2月的老版本Mythos Preview以74.2%的微弱优势,在胜率上险胜了Sol的73.5%。


但是,全场的焦点在于能效比。

数据显示,Sol在取得73.5%的高胜率时,仅仅消耗了12万个输出Token;而Claude Mythos Preview为了达到相似的水平,竟然疯狂燃烧了33.5万个输出Token!

这意味着,在网络防御和漏洞修复的实战部署中,Sol的经济成本是Anthropic的三分之一。


在Token消耗上的「降维打击」,让Sol拥有压倒性优势。

而在另外两个网安基准上,双方互有胜负。

CyberGym:Sol以83.6%的成绩,微弱压倒了Mythos Preview的83.1%。

CyScenarioBench:则是Anthropic的天下,Mythos Preview以29.2%的胜率压制了Sol的28.0%。

HealthBench Professional:Anthropic更是凭借其深厚对齐底蕴,以66.0%的高分大幅领先Sol的60.5%。

此外,在量化生物学与基因组学基准GeneBench v1上,Sol在消耗更少Token的前提下,将准确率一举拉高到了30%。

ExploitGym测试同样证实:随着推理算力的持续向外扩展,GPT-5.6的三款模型性能均呈现出近乎线性的上扬,这意味着Sol的compute潜力巨大。

总而言之,GPT-5.6 Sol与Claude Mythos 5的交锋,结果是战平。

双方在各个细分领域缠斗,没有任何一方绝对垄断。

被锁进保险箱的AI之王

遗憾的是,这一次,GPT-5.6遭受了和Mythos 5同等级别的待遇,甚至更加严苛。

在强硬指令下,OpenAI不得不宣布:GPT-5.6 Sol目前仅处于极度受限的「有限预览」状态。

只有极少数被列入受信白名单的承包商、国家级网络安全机构以及顶级战略合作伙伴,才能通过API和Codex使用。

普通企业和民间开发者,被无情地拒之门外。

对此,OpenAI十分愤怒,在官方公告中控诉:

我们认为这种政府访问流程不应成为长期默认做法。它使用户、开发者、企业、网络安全防御者和需要这些工具的全球合作伙伴无法获得最佳工具。

OpenAI之所以敢于公开叫板,底气来源于刚刚发布的报告。

在报告中反复强调,根据在谷歌浏览器和Firefox环境下的实战测试,Sol虽然能捕捉到复杂的系统Bug和漏洞原语,但它至今未能表现出完全自主独立生成「全链条端到端攻击」的能力。


在他们看来,GPT-5.6的危险指数依然控制在「关键网络安全威胁」的红线之下,还不会自我进化,主动向人类网络发起进攻。

然而METR的报告显示,恐怕并非如此。

普通用户,何时能等来GPT-5.6?

参考资料:

https://x.com/METR_Evals/status/2070584331068969336

https://x.com/ChrissGPT/status/2070592285973041251https://the-decoder.com/openais-claude-mythos-competitor-gpt-5-6-sol-launches-under-government-controlled-access-it-calls-unsustainable/

编辑:Aeneas


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
中老年“黄金血压值”已公布!不是120/80,而是这数越接近越放心

中老年“黄金血压值”已公布!不是120/80,而是这数越接近越放心

观星赏月
2026-07-20 16:57:27
博主:U16主帅大卫是被中国足协直接开除的,而非因待遇问题

博主:U16主帅大卫是被中国足协直接开除的,而非因待遇问题

懂球帝
2026-07-20 14:35:26
A股关键时刻,收盘刚过了2分钟,证监会火速发声,吴清与8名大中小散投资者代表面对面交流,投资者反馈“量化交易和AI应用”等敏感话题

A股关键时刻,收盘刚过了2分钟,证监会火速发声,吴清与8名大中小散投资者代表面对面交流,投资者反馈“量化交易和AI应用”等敏感话题

金融界
2026-07-20 17:18:41
撑杆跳女神曝被镜头死盯隐私部位,新规出炉,低角度偷拍行不通

撑杆跳女神曝被镜头死盯隐私部位,新规出炉,低角度偷拍行不通

青梅侃史啊
2026-07-20 11:44:57
49岁夏奇拉世界杯中场秀惊艳,三次人生暴击后美貌只是标配

49岁夏奇拉世界杯中场秀惊艳,三次人生暴击后美貌只是标配

草莓解说体育
2026-07-20 16:36:05
四年后再见,再无梅罗!2030世界杯六国联办,南美三国揭幕战!

四年后再见,再无梅罗!2030世界杯六国联办,南美三国揭幕战!

海浪星体育
2026-07-20 09:47:51
证监会主席吴清警示科技股炒作 单日72家公司发澄清公告

证监会主席吴清警示科技股炒作 单日72家公司发澄清公告

观点机构
2026-07-20 18:44:51
奥尔莫女友社媒庆祝西班牙夺冠:我的男友成世界杯冠军了

奥尔莫女友社媒庆祝西班牙夺冠:我的男友成世界杯冠军了

懂球帝
2026-07-20 16:54:13
每一次证监会稳市场座谈会后,A股都发生了什么?

每一次证监会稳市场座谈会后,A股都发生了什么?

财联社
2026-07-20 18:51:19
中纪委怒批:公务员也是人,正常生活不应问责处理!

中纪委怒批:公务员也是人,正常生活不应问责处理!

细说职场
2026-07-20 18:29:38
太猛了!仁爱礁冲突现场曝光:中国海警几棍子就打怵了菲律宾人!

太猛了!仁爱礁冲突现场曝光:中国海警几棍子就打怵了菲律宾人!

阿龙聊军事
2026-07-20 21:55:17
OpenAI高管炮轰Kimi K3:中国开源是减速主义 会抑制资本投入

OpenAI高管炮轰Kimi K3:中国开源是减速主义 会抑制资本投入

快科技
2026-07-20 14:46:08
波兰320公里高铁招标:西门子阿尔斯通日立都到了,中车为何没上桌

波兰320公里高铁招标:西门子阿尔斯通日立都到了,中车为何没上桌

王新喜
2026-07-20 23:04:16
第21轮打击,伊朗领导层投降了?土耳其提醒中国:抓紧跟三国结盟

第21轮打击,伊朗领导层投降了?土耳其提醒中国:抓紧跟三国结盟

影孖看世界
2026-07-20 19:53:09
45岁余文乐官宣离婚:7年婚姻走到尽头,参加披哥疗伤再出发?

45岁余文乐官宣离婚:7年婚姻走到尽头,参加披哥疗伤再出发?

新金牌娱乐观察家
2026-07-20 14:26:48
一场0-1,输球不可怕,可怕的是赛后梅西这番话:让人很揪心

一场0-1,输球不可怕,可怕的是赛后梅西这番话:让人很揪心

阿振观点
2026-07-20 08:00:01
汤姆·布雷迪承认:“代价不菲”,他买下了一张稀有的费尔南多·门多萨卡

汤姆·布雷迪承认:“代价不菲”,他买下了一张稀有的费尔南多·门多萨卡

慢享生活集
2026-07-20 01:52:16
余文乐宣布与妻子离婚:尊重并祝福彼此的人生选择

余文乐宣布与妻子离婚:尊重并祝福彼此的人生选择

草莓解说体育
2026-07-20 14:19:14
美军连炸8晚后,伊朗宣布“退群”,美国发全球警告,特朗普急了

美军连炸8晚后,伊朗宣布“退群”,美国发全球警告,特朗普急了

游古史
2026-07-20 12:37:21
西班牙可获5100万美元奖金,球员将各得一座镀金复制品大力神杯,阿根廷可获得3400万美元

西班牙可获5100万美元奖金,球员将各得一座镀金复制品大力神杯,阿根廷可获得3400万美元

鲁中晨报
2026-07-20 11:04:55
2026-07-21 07:08:49
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
15742文章数 66964关注度
往期回顾 全部

科技要闻

网易科技"未来大奖2026上半年AI榜单"揭晓

头条要闻

美国宣布对加拿大部分产品加征50%关税

头条要闻

美国宣布对加拿大部分产品加征50%关税

体育要闻

65岁肌肉男,世界杯最年长冠军主帅

娱乐要闻

谢霆锋发文确认父亲谢贤去世 享年89岁

财经要闻

AI开始挤泡沫

汽车要闻

综合续航超1600km 2027款星途ES上市置换价16.99万起

态度原创

数码
家居
健康
艺术
公开课

数码要闻

曝谷歌正研发全新Frozen v2芯片,可大幅提升Gemini模型运行效率

家居要闻

2026建博会(广州) 公装联探展交流活动

“斑块”患者要小心中风?

艺术要闻

世界上10个最危险景点,你敢去吗?

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版