网易首页 > 网易号 > 正文 申请入驻

Claude挖出火狐浏览器22个漏洞、14个高危!安全研究规则该变了?

0
分享至

来源:市场资讯

(来源:机器之心Pro)

机器之心编辑部

近日,Anthropic 公布了一组惊人的数字,在与 Mozilla 公司进行合作,测试旗下模型 Claude Opus 4.6 发现漏洞能力的过程中,两周内,就找出 Mozilla 公司「火狐」(Firefox)浏览器中 22 个不同的漏洞,其中 14 个是「高危漏洞」级别,而这几乎是 Mozilla 2025 年修复的全部「高危漏洞」的五分之一。

换句话说:AI 正以极快的速度帮助人类检测出严重的安全漏洞。

此消息一出,引起网友热议。

网友 sunxiayi 认为,Claude 能够在两周内发现如此多数量的漏洞真是「疯狂」,「这基本上相当于整个安全团队的季度工作。」

而在 AI 如何疯狂、高效的工作能力面前,人类安全工程师似乎在失去竞争优势。

网友则认为,Claude 的这一战绩无疑是在表明,当下大家正在经历从「AI 辅助编程」到「AI 从根本上改变安全研究运作方式」的转变。而这种规模的自动化漏洞能力,也就意味着,每一个代码库在 AI 扫描面前都将变得「透明」。

同样,也有网友表示担忧,短时间内能够找到安全漏洞固然让人印象深刻,但更令人担忧的是,「这对进攻端意味着什么?」如果一个模型能在如此短的时间内发现 Firefox 中的 14 个高危漏洞,那么攻击面发现的博弈规则已经发生了永久性的改变:防御方获得了一个利器,但其他人(攻击者)也同样拥有了它。」

而网友针对此事的反应如此激烈,其实也在一定程度上说明,在大模型技术快速发展的当下,安全问题已然变得愈加重要,软件安全性依然是各大技术发展过程中的重中之重。

接下来,我们就来具体了解一下此次 Anthropic 与 Mozilla 合作的详情,以及到底 Claude Opus 4.6 是如何能够做出这样的成绩的。

从模型评测到安全合作

2025 年底,Anthropic 注意到 Opus 4.5 在 CyberGym(一个用于测试 LLM 是否能够复现已知安全漏洞的基准测试)上已经几乎能够解决所有任务,于是,团队希望构建一个「更困难、更贴近真实世界」的评估环境,其中包含更高比例的技术复杂漏洞,例如现代浏览器中所存在的漏洞。

因此,Anthropic 建立了一个关于 Mozilla 的 Firefox 历史 CVE(通用漏洞披露)的数据集,以观察测试 Claude 是否能够复现这些漏洞。

之所以选择 Firefox,是因为它既是一个复杂的代码库,也是世界上测试最充分、最安全的开源项目之一,这对 AI 发现新型安全漏洞的能力是一个更严峻的考验。而相较于 Anthropic 之前测试模型的开源软件相比,这明显更具挑战性。每天有数亿用户依赖它,而浏览器漏洞尤为危险,因为用户经常接触不受信任的内容,并依赖浏览器来保证安全。

团队所做的第一步是使用 Claude 在旧版本 Firefox 代码库中寻找已知 CVE。令人惊讶的是,Opus 4.6 能够复现相当高比例的历史漏洞,而这些漏洞当初往往需要研究人员付出大量人力才能发现。

不过,当时大家对这个结果仍然存在疑问,因为这些历史漏洞可能出现在 Claude 的训练数据中。因此,仅凭这一结果还不足以证明模型真正具备漏洞发现能力。

于是,团队让 Claude 去寻找当前 Firefox 版本中的新漏洞。也就是说,这些漏洞此前从未被报告过。最初专注于 Firefox 的 JavaScript 引擎,随后逐步扩展到浏览器的其他部分。

之所以选择 JavaScript 引擎的原因包括:

而就在仅仅 20 分钟探索后,Claude Opus 4.6 报告称发现了一个 Use-After-Free(释放后重用)漏洞。这种漏洞属于内存安全漏洞,可能允许攻击者用任意恶意内容覆盖数据。

研究人员在一个独立虚拟机中验证了该漏洞,并使用最新 Firefox 版本确认问题存在。随后两名 Anthropic 研究员再次验证。于是,Anthropic 在 Mozilla 的问题追踪系统 Bugzilla 中提交了 Bug 报告,并附带了漏洞描述和一份建议补丁(由 Claude 编写并由报告团队验证),以帮助分类溯源。

而就在 Anthropic 验证并提交第一个漏洞的时间里,Claude 已经发现了另外 50 个崩溃输入样本。在对这些崩溃进行分类时,一位 Mozilla 研究人员建议批量提交所有发现,即使不确定所有崩溃案例是否都有安全影响,也不必逐一验证。

最终,Anthropic 扫描了近 6000 个 C++ 文件,并提交了总计 112 份独立漏洞报告,其中就包括上述所说的高危和中危漏洞。目前,大多数问题已在 Firefox 148 中修复,其余问题将在后续版本中修复。

从发现漏洞到开发利用代码

为了测试 Claude 在网络安全方面的能力上限,Anthropic 还设计了一项新评估,以确定 Claude 是否能够利用所发现的这些漏洞。换句话说,团队想了解 Claude 是否也能开发出黑客攻击所需的工具,利用漏洞执行恶意代码?

团队向 Claude 提供已提交给 Mozilla 的漏洞,并要求它为每一个漏洞开发一个利用程序(exploit)。

为了证明利用成功,要求 Claude 演示一次真实的攻击。具体而言,它必须像攻击者一样,在目标系统中读取并写入一个本地文件。

为此,团队运行了数百次实验,消耗了约 4000 美元的 API 费用,而结果显示:Claude 只成功利用了两个漏洞。

这说明两件事:

但需要注意的是:Claude 确实成功自动生成了浏览器 exploit(尽管只有少数案例),这一点仍然令人担忧。

另外,需要强调的是,Claude 写出的 exploit 非常原始,仅在测试环境中有效,而该测试环境移除了部分浏览器安全机制,尤其是 sandbox(沙箱),其目的是降低此类漏洞的影响。

因此,在真实 Firefox 中,其本身的纵深防御(defense-in-depth) 可以有效阻止这些特定的 exploit。

不过,突破沙箱的漏洞并非不存在,而 Claude 的攻击已经完成了完整攻击链中的一个关键环节。

AI 驱动的网络安全未来

这些 AI 辅助 exploit 开发的早期迹象,凸显了防御者加速「发现与修复」流程的重要性。为此,Anthropic 想分享一些在执行此分析时发现的技术和流程最佳实践。

首先,在研究 LLM 开发和验证补丁的「补丁 Agent」(patching agents)时,团队开发了几种方法,希望能帮助维护者使用 Claude 等 LLM 更快地分类和处理安全报告。

根据经验,当 Claude 能够使用另一个工具检查自己的工作时,表现最佳。团队将这类工具称为「任务验证器(task verifier)」:这是一种确信 AI Agent 的输出是否真正实现其目标的可靠方法。验证器在代理探索代码库时提供实时反馈,允许其深入迭代直到成功。

「任务验证器」帮助团队发现了上述 Firefox 漏洞,在其他研究中,发现它们在修复 Bug 方面也很有用。一个优秀的补丁 Agent 至少需要验证两件事:漏洞是否已被真正消除,以及程序的预期功能是否得以保留。

在 Anthropic 的工作中,团队构建了能够自动测试在建议修复后原始 Bug 是否仍能被触发的工具,并独立运行测试套件以捕捉回归(regressions)(即意外破坏其他功能的更改)。

团队预计,维护者最清楚如何为自己的代码库构建这些验证器。关键点在于,给 Agent 一个可靠的方法来检查这两个属性,可以显著提高其输出质量。

https://techcrunch.com/2026/03/06/anthropics-claude-found-22-vulnerabilities-in-firefox-over-two-weeks/

https://www.anthropic.com/news/mozilla-firefox-security

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“我攒的万岁山龙形银票为啥作废了?”游客质疑:没标注使用期,如此处理不妥;景区:以后加强告知

“我攒的万岁山龙形银票为啥作废了?”游客质疑:没标注使用期,如此处理不妥;景区:以后加强告知

大风新闻
2026-09-29 15:40:29
胡歌低调现身游本昌遗体告别仪式,含泪送别爷叔最后一程。

胡歌低调现身游本昌遗体告别仪式,含泪送别爷叔最后一程。

徐醇老表哥
2026-09-30 15:24:42
清华讲台,翁帆还没开口,衣服先替她说了话!她一出现,目光就被那身打扮勾住了,这样的翁帆,确实让人移不开眼!

清华讲台,翁帆还没开口,衣服先替她说了话!她一出现,目光就被那身打扮勾住了,这样的翁帆,确实让人移不开眼!

财经要参
2026-09-30 19:39:44
那个坐拥890万粉丝、体重一度逼近500斤的内蒙古网红“羊亡爷”恩克,步履虚浮难进食,暴食流量终要拿健康买单

那个坐拥890万粉丝、体重一度逼近500斤的内蒙古网红“羊亡爷”恩克,步履虚浮难进食,暴食流量终要拿健康买单

LULU生活家
2026-09-25 15:16:25
闹大了!乒协官网祝贺王曼昱遭围攻,冲上热搜,7.3亿阅读量

闹大了!乒协官网祝贺王曼昱遭围攻,冲上热搜,7.3亿阅读量

小鞄搞笑解说
2026-09-30 12:02:54
台湾媒体人黄智贤终于露出了原型,全力帮助绿营助选!

台湾媒体人黄智贤终于露出了原型,全力帮助绿营助选!

总在茶余后
2026-09-30 15:39:02
老了肌肉流失怎么办?医生:2样东西必须吃,2件事做得越早越好

老了肌肉流失怎么办?医生:2样东西必须吃,2件事做得越早越好

健康科普365
2026-09-30 11:40:19
工商银行、农业银行、中国银行、建设银行、交通银行、邮储银行,集体公告

工商银行、农业银行、中国银行、建设银行、交通银行、邮储银行,集体公告

第一财经资讯
2026-09-30 15:00:58
四平溃败东北濒临崩盘,无人敢战之际,却被闲置时的陈光一战翻盘

四平溃败东北濒临崩盘,无人敢战之际,却被闲置时的陈光一战翻盘

纪史行者
2026-09-27 06:35:06
太惨!纯电车价格再次“跳水”,最大降幅50%,国庆节该抄底吗?

太惨!纯电车价格再次“跳水”,最大降幅50%,国庆节该抄底吗?

三农老历
2026-09-30 06:36:57
刚刚,十个Claude 5.5攻克百年物理猜想!

刚刚,十个Claude 5.5攻克百年物理猜想!

新智元
2026-09-30 10:58:28
一个家庭最大的悲哀:没有一个社会化的人

一个家庭最大的悲哀:没有一个社会化的人

心理观察局
2026-06-07 06:15:05
据史料记载,抗美援朝时期,中国和朝鲜双方都禁止解放军与朝鲜妇女通婚。

据史料记载,抗美援朝时期,中国和朝鲜双方都禁止解放军与朝鲜妇女通婚。

回京历史梦
2026-10-01 06:35:14
筹划重大资产重组一年半,长假前夜宣布终止,300449:假期后携标的公司代表举行说明会

筹划重大资产重组一年半,长假前夜宣布终止,300449:假期后携标的公司代表举行说明会

每日经济新闻
2026-09-30 22:04:04
葡权媒不惯着C罗:国家队利益高于所有人 他对抗教练也对抗自己!

葡权媒不惯着C罗:国家队利益高于所有人 他对抗教练也对抗自己!

风过乡
2026-10-01 07:04:57
霉菌超出国标限值27倍,这种几乎人人都吃的老品牌,被曝光了

霉菌超出国标限值27倍,这种几乎人人都吃的老品牌,被曝光了

爆炸营养彭鑫蕊
2026-09-30 14:22:46
只要不嫌脏不嫌丢人,就去干这9个冷门活路,闷声发财!

只要不嫌脏不嫌丢人,就去干这9个冷门活路,闷声发财!

另子维爱读史
2026-09-24 19:10:42
基辅反复被炮轰,乌克兰人发出灵魂拷问:俄导弹为何不炸泽连斯基

基辅反复被炮轰,乌克兰人发出灵魂拷问:俄导弹为何不炸泽连斯基

墨子翟的日记y
2026-09-30 15:29:38
年销920亿美元!欧美人爱到疯狂,为何偏偏撬不开中国人的嘴

年销920亿美元!欧美人爱到疯狂,为何偏偏撬不开中国人的嘴

乌克兰小静
2026-09-30 08:16:43
傅园慧现状:成为浙大老师,对感情不将就,30岁不缺钱享受生活

傅园慧现状:成为浙大老师,对感情不将就,30岁不缺钱享受生活

大西体育
2026-09-30 23:33:03
2026-10-01 10:23:00
新浪财经 incentive-icons
新浪财经
新浪财经是一家创建于1999年8月的财经平台
4945332文章数 9702关注度
往期回顾 全部

科技要闻

等了近一年!谷歌新旗舰亮相,普通用户还得等

头条要闻

33岁"草根歌手"侯浪救场李克勤爆火:一直看观众走没走

头条要闻

33岁"草根歌手"侯浪救场李克勤爆火:一直看观众走没走

体育要闻

30天30队·火箭:乌度卡的控制欲

娱乐要闻

胡歌现身游本昌遗体告别仪式

财经要闻

“杭州六小龙”迎来价值重估

汽车要闻

燃油车的最佳平替 长城大狗HEV简单好开更经济

态度原创

手机
旅游
房产
健康
数码

手机要闻

iPhone Duo本月发售:良率只有60%多 黄牛火速上线代抢服务

旅游要闻

泰山之巅朝霞漫天 游客齐聚峰顶 齐声合唱《歌唱祖国》迎接国庆

房产要闻

利好频发!国庆置业窗口期,收好这份优惠攻略!

刷酸祛痘,为什么有人翻车?

数码要闻

高效轻量化Agentic PC解决方案,Lecoo酷310锐龙版迷你台式机测评

无障碍浏览 进入关怀版