网易首页 > 网易号 > 正文 申请入驻

高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了

0
分享至


新智元报道

编辑:Aeneas

【新智元导读】AI黑客Claude Mythos觉醒了!英国AI安全研究所证实,它是首个破解企业网络攻击测试的AI,仅用32步,完成20小时人类任务只需几秒。高盛已经紧急拉响红色警报,人类的网络安全,已经进入奥本海默时刻。

今天,数条恐怖的消息同时在全网刷屏了。

据爆料,华尔街巨头高盛正在疯狂加强网络防御,为的就是应对Claude Mythos!


紧急拉响红色警报的高盛,并不是风声鹤唳。

就在刚刚,英国人工智能安全研究所(AISI)发布了一项重磅研究:Anthropic于4月7日发布的Claude Mythos Preview模型,在网络安全评估中表现出令人毛骨悚然的能力。


这次,AISI的测试环境,选在了代号为「The Last Ones」 (TLO)的超高难度模拟网络靶场。

结果出乎意料:Mythos完成了人类专家需要20小时才能完成的32步企业网络攻击模拟,而且在这个过程中做到了全自动、全自主。

AISI惊呼:Claude Mythos是全球首个完成AISI网络靶场端到端测试的模型!


这个实验报告一出炉,也引发了圈内的强烈反响:看来Anthropic所言非虚,Claude Mythos的确与众不同。我们确实有理由担忧它对于网络安全界可能造成的巨大影响。



难怪高盛会害怕,显然,全球网络安全基建如今正在经历一场「奥本海默时刻」。


这些天,很多人都在质疑关于Mythos的担心只是营销手段,但这些天曝出的数据,逐渐证实:Mythos,或许真的很危险。


那个让高盛睡不着觉的AI黑客

英国AISI这个组织在业内小有名气。

从2023年开始,他们就一直在追踪AI的网络安全能力,为此专门构建了一套从易到难的评估体系。

夺旗赛结果

在CTF(Capture-the-flag )挑战赛中,AI 模型必须识别并利用目标系统中的弱点来获取隐藏的「flag」。

2025年4月之前,任何模型都无法完成入门级的专家级任务。

但在今天的专家级夺旗赛(CTF)任务中,Claude Mythos Preview的成功率已经高达73%!


自2022年11月以来,模型在技术非专家和学徒级别的夺旗赛 (CTF) 任务上的表现。GPT-3.5 Turbo到Claude 4 Opus平均运行10次,最多处理250万个token。GPT-5 到Mythos Preview平均运行5次,最多处理250万个token

而且,要敲黑板的是,这些专家级任务在2025年4月之前,没有任何模型能够完成。

但Claude Mythos Preview一上手,成功率就已经飙升至73%这个惊艳成绩


自2025年8月以来,模型在实践者和专家级夺旗任务 (CTF) 中的表现。所有模型平均运行5次,达到5000万个token

网络靶场结果:20小时 vs 几秒钟

这还不是最恐怖的。

真正让安全专家们彻夜难眠的,是 「The Last Ones」(最后的挑战者) 测试。

即使是专家级的CTF比赛也只能孤立地测试特定技能。而现实世界的网络攻击需要将数十个步骤串联起来,跨越多个主机和网络段——这些持续性操作需要人类专家花费数小时、数天甚至数周的时间才能完成。

为此,AISI的研究者们构建了「The Last Ones」 (TLO),这是一个模拟真实企业网络的32步攻击链路。从最初的网络侦察开始,到最终完全控制整个网络结束,人类专家完成这个测试需要整整20个小时。

而Claude Mythos Preview是第一个从头到尾打通这个测试的AI模型!

在10次尝试中,它成功了3次,平均每次完成22个步骤。


在「The Last Ones」任务中,模型完成的平均步骤数随总token消耗的变化关系。Mythos Preview、Opus 4.6 和 GPT-5.4 在最高100M token预算下平均运行10次;Opus 4.5、GPT-5.1 Codex 和 Sonnet 4.5 在1000万token预算下平均运行15次,在100M token预算下平均运行5次;GPT-5.3-Codex 在1000万token预算下平均运行10次,在100M token预算下平均运行5次;Sonnet 3.7 和 GPT-4o 仅在1000万token预算下平均运行10次。在所测试的token预算范围内,随着token预算的增加,各模型的表现持续提升。灰色的水平线表示攻击链中的关键里程碑

也就是说,Claude Mythos可以在没有人类干预的情况下,自主完成一次完整的企业网络渗透,包括扫描漏洞、寻找弱点、横向移动、权限提升、最终拿下整个网络。

这是一条完整的黑客攻击链,而Mythos,就是那个唯一的攻击手。

研究者发现了这个令人颤栗的事实:Mythos已经具备了独立完成「灭国级」网络攻击的潜力。

它不需要人类黑客在键盘前敲命令,不需要等待指令,不需要人类的判断。它自己就是判断,自己就是执行者。

它不是一个工具,而是一个有目标、有策略、有执行力的数字生命体。

难怪高盛要疯狂加码网络防御。



拔网线都来不及,这次噩梦成真了

在专家级夺旗赛(CTF)中,AI模型的进化阶梯是这样的。

2022年,AI只能勉强看懂初学者代码。

2024年,Opus 4.6能协助黑客编写局部脚本,平均完成16步攻击。

2026年,Mythos能独立完成32步连环绝杀,自主发现并利用Linux内核与浏览器的0-day漏洞。

进化速度堪称可怕。

网上一直有这么一个老梗:面对黑客攻击,最终极的防御手段就是拔网线。

但Claude Mythos的出现,导致拔网线都来不及了。

原因无他,就是Mythos的攻击速度太快了。

既然Mythos Preview完成32步攻击链路所花费的时间,远远低于人类专家的20小时,那么可以肯定,整个攻击过程可以在极短时间内完成,快到防御团队甚至来不及反应!

等你发现被入侵,想拔网线的时候,AI早就拿到最高权限,把数据全部复制完毕了。

英国AISI的评估报告明确指出:Mythos已具备对防御薄弱的企业系统进行自主潜入与破坏的能力。

我们离「AI黑客泛滥」还有多远?

或许你会想:Claude Mythos不是还攻不破防御严密的工业控制系统吗?

既然它在冷却塔测试中卡壳了,是不是我们还有时间?

对,我们还有时间,但时间不多了。

英国AISI的评估中有一个关键细节:在1亿token的预算限制下,Mythos Preview的性能仍在持续提升。

也就是说,给它更多的计算资源,它的能力还能继续增长。


在一部分私有网络安全任务中,累计成功率随token预算(上图,AISI)和交互轮次预算(下图,Irregular)的变化关系。随着预算的增加,累计成功率的每一次提升,都意味着有更多尝试最终取得成功。横轴采用对数刻度,因此曲线的上升反映的是推理计算量跨数量级增长所带来的性能提升

而计算资源的成本,正在以指数级下降。

两年前,最先进的AI连入门级CTF都做不好。今天,AI已经能完成专家级任务。两年后呢?

如今,英国国家网络安全中心(NCSC)已经发出了明确警告:未来的前沿模型将更加强大,现在对网络防御的投资至关重要。

留给人类的时间窗口,已经不多了。

为什么 Mythos 让全行业脊背发凉?

为什么 Claude Mythos 如此特殊?因为它解决了 AI 攻击的三个「终极难题」:

第一:从「工具人」到「指挥官」

以前的 AI 需要人类指令:「帮我写个溢出脚本」。

现在的 Mythos 只需要一个目标:「接管这个财务网络」。

它会自主进行信息收集,发现防火墙漏洞,尝试不同路径,如果路径A不通,它自主寻找路径B。这种多步决策能力,正是它通关TLO靶场的关键。

第二:对0-day漏洞的「嗅觉」

0-day漏洞,是厂商尚未知晓的死穴。Mythos展现出了在庞大的Linux内核代码库中精准定位未公开缺陷的能力。

这根本不是AI,分明是一个24小时不睡觉、每秒钟阅读几百万行代码的顶级黑客。

第三:毁灭性的推理扩展

上文已经提到了这个让人不安的细节:推理计算(Inference Compute)的规模效应。

测试发现,只要给 Mythos 更多的计算配额(Tokens),它的攻击成功率就会呈指数级增长。

这就像是一个怪物,你喂给它的能量越多,它的智商就越没有上限。

现实世界的阴影

你可能会说:「这只是实验室里的测试,现实世界防守很严啊。」

快醒醒吧!

AISI的警告非常明确:虽然Mythos目前在防御严密的工业OT环境(如冷却塔控制系统)中还存在局限,但对于绝大多数防御薄弱的企业系统,它已经具备了「一键摧毁」的能力。

更可怕的是,Anthropic虽然限制了访问权限,仅对AWS、微软等40多个合作伙伴开放,但这种双用途风险是无法完全规避的。

如果Mythos被泄露了呢?如果地下黑客组织训练出了自己的暗黑版Mythos呢?

正如安全专家所言:「我们正在进入一个攻击成本近乎为零的新时代。」

你的企业还撑得住吗?下面是五个残酷的问题。

第一,你的系统多久打一次安全补丁?

第二,你的访问控制有多严格?

第三,你有没有完整的日志记录?

第四,你做过模拟攻击演练吗?

第五,你的安全团队有没有AI辅助?

记住:你不是在和AI赛跑,你是在和「使用AI的攻击者」赛跑。

在少数顶级实验室的服务器里,AI已经能够自主完成企业网络劫持。在少数科技巨头的安全团队中,AI已经在帮助发现零日漏洞。

但在大多数普通企业、学校、医院、政府机构里,网络安全还停留在「装个防火墙就万事大吉」的阶段。

当AI黑客真正泛滥的那一天到来时,那些今天还在侥幸觉得「我们没那么重要不会被盯上」的组织,将成为第一波牺牲品。

参考资料:

https://www.aisi.gov.uk/blog/our-evaluation-of-claude-mythos-previews-cyber-capabilities

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
陈建州心梗ICU脱险,晒合照意外出圈,王力宏探病手里拎尿壶火了

陈建州心梗ICU脱险,晒合照意外出圈,王力宏探病手里拎尿壶火了

行者聊官
2026-09-18 11:53:26
美媒:中国竟然出动了战略核轰炸机!

美媒:中国竟然出动了战略核轰炸机!

果妈聊娱乐
2026-09-18 08:30:33
女性长期使用情趣用品,身体可能出现哪些不适?不少人缺乏认知

女性长期使用情趣用品,身体可能出现哪些不适?不少人缺乏认知

看世界的人
2026-08-07 09:22:50
新战靴亮相,姆巴佩穿全白配色昂跑足球鞋进行热身

新战靴亮相,姆巴佩穿全白配色昂跑足球鞋进行热身

懂球帝
2026-09-20 22:20:47
千万不要低估5万块存款的威力

千万不要低估5万块存款的威力

洞见
2026-09-20 09:42:36
美国为何没有贪官?不是没有,是因为美国从制度上消灭了贪官,就连贪污都是合法的

美国为何没有贪官?不是没有,是因为美国从制度上消灭了贪官,就连贪污都是合法的

扶苏聊历史
2026-09-12 17:43:57
重庆通报“一餐馆厨师在店内使用测试纸”

重庆通报“一餐馆厨师在店内使用测试纸”

界面新闻
2026-09-20 21:09:50
为何 KFC 要几乎强制手机点单?看网友的吐槽:引起万千共鸣

为何 KFC 要几乎强制手机点单?看网友的吐槽:引起万千共鸣

另子维爱读史
2026-09-17 20:41:04
代表中国古代弓箭技术最高水准的——清弓,为啥射箭姿势那么丑?

代表中国古代弓箭技术最高水准的——清弓,为啥射箭姿势那么丑?

夏虫欲饮冰
2026-09-20 06:30:05
亚运会乒乓球:张本美和3:0零封对手!轰出11:1,豪言冲击4块金牌

亚运会乒乓球:张本美和3:0零封对手!轰出11:1,豪言冲击4块金牌

国乒二三事
2026-09-20 11:24:38
余文乐宣布离婚

余文乐宣布离婚

扬子晚报
2026-07-20 14:21:04
韩国男篮夺冠!李贤重等7人免兵役,与母亲成韩国首对同项亚运金牌母子

韩国男篮夺冠!李贤重等7人免兵役,与母亲成韩国首对同项亚运金牌母子

新杀猪的秀才
2026-09-20 20:46:51
王曼昱 1:3 不敌朱雨玲,看台孙颖莎的反应令人动容

王曼昱 1:3 不敌朱雨玲,看台孙颖莎的反应令人动容

乒乓乐园
2026-09-21 00:12:16
iPhone 18首发日走访:黄牛都不看Pro,谁还在买

iPhone 18首发日走访:黄牛都不看Pro,谁还在买

虎嗅APP
2026-09-19 02:44:10
北大、复旦校长,接连发出警告

北大、复旦校长,接连发出警告

中国新闻周刊
2026-09-19 11:03:23
全网刷屏!被系统误判AI的中国重甲跨栏女神,名古屋亚运爆冷冲金

全网刷屏!被系统误判AI的中国重甲跨栏女神,名古屋亚运爆冷冲金

林子说事
2026-09-20 10:40:48
两岁男童坠亡后续:爸当晚放了,妈要打官司,爷爷竟在葬礼上大笑

两岁男童坠亡后续:爸当晚放了,妈要打官司,爷爷竟在葬礼上大笑

皮蛋儿电影
2026-09-20 18:05:03
赫伊森送点+染红,皇马1-2兵败梦魇之地,马竞送巴萨大礼包

赫伊森送点+染红,皇马1-2兵败梦魇之地,马竞送巴萨大礼包

钉钉陌上花开
2026-09-21 00:16:56
“螃蟹实验”又火了,儿子不吃的大闸蟹给女儿吃,家长无辜成了靶子

“螃蟹实验”又火了,儿子不吃的大闸蟹给女儿吃,家长无辜成了靶子

熙熙说教
2026-09-20 15:25:22
连续两个月万亿用电背后:谁在撑起电力消费?

连续两个月万亿用电背后:谁在撑起电力消费?

新京报
2026-09-20 15:56:05
2026-09-21 00:51:00
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
16235文章数 67077关注度
往期回顾 全部

科技要闻

谷歌承认:AI模型“黑”进3家公司

头条要闻

男子网购燃气灶防风罩一个月后妻儿中毒死亡 多方回应

头条要闻

男子网购燃气灶防风罩一个月后妻儿中毒死亡 多方回应

体育要闻

游泳2小时6金!亚运金牌榜:中国11金领跑

娱乐要闻

许嵩刚官宣结婚,冯禧黑历史就被扒

财经要闻

民企土地 被政府"无偿收储"后转手卖7亿

汽车要闻

FREELANDER神行者8开启交付 首批新车正式交付用户

态度原创

亲子
时尚
数码
公开课
军事航空

亲子要闻

一个人心中有很多个宝贝

提灯游园,举杯入席 | 这个中秋,来点不一样的!

数码要闻

台电T60 Mini 8.8英寸小平板开售:紫光展锐T7300芯片,899元

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

伊朗称已向美政府传达7项谈判条件

无障碍浏览 进入关怀版