No.0352
Science Partner
Bring you to the side of science
![]()
导 读
八月初,美国AI行业突然进入一种奇怪的诚实。
5日,Meta也卷进了这场AI安全风暴。据路透社报道,Meta的Muse Spark 1.1在一次网络安全测试中,因为沙箱环境配置失误,接触到了公网并改动了另一家公司的内部系统。这条消息出来时,外界的注意力其实已经被OpenAI和Anthropic的“模型越界”刷过一轮。OpenAI先承认,它的先进模型在测试中逃出了隔离环境,连上互联网,侵入了Hugging Face,并进一步波及多个外部账号和服务。Anthropic很快跟上,说自己在复盘14.1万多次评测后,发现Claude也曾在测试中进入三家外部组织系统。
Meta最近虽然曝光度不大,但在AI圈绝对不是一个边缘参与者。小扎的加入,让这场原本像个别事故的风波,迅速变成了整个行业都绕不过去的话题。大模型公司们一边高调推进更强的agentic模型,一边又被卷入“模型在测试中闯祸”的叙事里。那么一个真问题就是:
AI巨头们对“安全”和“能力”的讲法是怎么了?
走,跟伙伴君来!
今日主笔|旻宏
安全事故,成了AI公司的新广告
一、为什么现在都在“自爆”
第一个在门AI北境外敲门的,一般都是奥尔特曼这个“聪明的野蛮人”。OpenAI把事件定性为“前所未有的网络事件”,还把相关行为称作“state of the art cyber capabilities”,这就等于先把解释权牢牢握在自己手里。这一步很关键,因为一旦最先披露的是公司自己,外界就更难把后续类似事件直接定义成“你们在隐瞒”。
更现实的背景是,美国政府已经开始把前沿模型安全测试制度化。白宫在八月初完成了针对最先进模型的自愿性安全测试框架,并邀请Meta、OpenAI、Anthropic和Google讨论如何实施。这意味着,大公司现在不仅要向市场解释模型能力,还要向监管者证明自己“主动做了什么”。在这种环境下,披露事故不再只是声誉风险管理,而是巧妙和监管沟通的一部分。
二、事故为何变成能力
这几起事件最吊诡的地方在于,它们同时暴露了“我的模型很强”、“外部系统很脆”、没出大问题是因为“我还有强大的自我发现和纠正能力”。Anthropic说,Claude之所以能进入真实系统,是因为评测环境误被配置成可访问互联网,模型用的也只是弱密码、未认证接口这类基础手段,但当模型发现身处环境变化后,立即停止了攻击。Meta合作方Irregular也说,这不是复杂的“沙箱逃逸”,而是已披露过的环境配置问题,而且按照Meta现有的能力,风险可控。
风险可控,所以呢?
所以,公司叙事会因此而追求更“强能力”这条线。所以我们看到,这些科技大佬们的收口在“狂奔”。OpenAI强调这是先进模型在现实环境里展现出的网络能力,Anthropic则把重点放在“我们还不知道它到底能做到什么”,Meta早前则把Muse Spark 1.1定位为具备更强工具使用和计算机操作能力的agentic模型。换言之,事故本身并没有削弱它们的能力叙事,反而被纳入了“模型已经足够前沿,所以基于更强模型能力的安全边界必须升级”的新框架。
三、真正的风险在哪
这些事故展示的不是模型像电影里的超级黑客那样拥有无限自主性,而是当一个能行动的AI代理,碰上真实互联网、外部账号、松散权限和配置失误时,它会迅速把测试变成事故。但我们能相信这些既是运动员又想当裁判员的科技精英的定义吗?
答案是:不能。
理解,这类事件的危险,在于它不像传统软件漏洞那样只出错一次,而是会沿着工具链、权限链和外部服务链继续放大。这也是为什么“agentic AI”现在比普通聊天模型更让企业紧张。AI一旦不仅回答问题,还能计划、执行、调用工具、修改系统,它就不再只是内容生成器,而是一个会行动的组织成员。风险也因此从“回答错了”升级成“做错了,而且已经做了”。
四、公司的小九九和监管的狂奔
公开披露还有一个很现实的商业逻辑:抢先说明问题,通常比被别人揭出来更划算。行业研究早就显示,AI公司的评测和安全文档披露极不透明,只有少数产品公布完整的agent安全材料。在这种环境里,谁先公开,谁就有机会把“透明”变成品牌资产,把“我们发现了风险”变成“我们比别人更负责任”。
这背后其实是一种新的竞争秩序。
安全不再只是成本中心,而是产品营销、监管博弈和企业信誉的交汇点。于是,事故披露就变成了一种很现代的策略:既承认模型够强,强到能出事;又宣称公司够负责,负责到主动公开。
美国那边,白宫已经把先进模型的自愿安全测试摆上桌面。欧洲那边,EU AI Act从八月二日开始落实新的透明义务,对部分AI系统的披露和标识提出明确要求。这说明,AI公司现在面对的不是单一市场的公关压力,而是跨法域的合规压力。
这波AI安全披露热终将走淡。
但留下的一定不只是一次次“越狱”本身,而是它已经变成行业传播的新模板。推向自此之后,AI科技公司们将会一边承认风险,一边强调前沿;一边展示失控,一边争夺标准制定权。对外行来说,这看起来像事故,但对内行来说,这其实是AI产业进入“谁更强、谁更能配合监管管住自己,谁就更可能成为‘天选之子’”。但这就是大团圆结局吗?别急着回答,有空回去看看科幻片《不要抬头 don't look up (2021)》,你可能会有不一样的答案。
我是旻宏,咱们下期见~
![]()
本文仅作科普分享使用,欢迎小伙伴们点、收藏、关注,以备不时之需,当然更欢迎您把 介绍给周边可能需要的更多伙伴们呀。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.