网易首页 > 网易号 > 正文 申请入驻

神话模型Fable 5被曝降智,只为防蒸馏?AI大佬抗议

0
分享至


新智元报道


【新智元导读】Fable 5正在引发众多质疑:一声「你好」就能触发警报,一问高端技术就会被暗箱降智。Anthropic的安全承诺,正在变成一场开源圈愤怒的「安全谎言」。

就在6月10日,Anthropic 正式推出了最强旗舰模型——Claude Fable 5!

作为 Mythos 级别的首款通用消费级模型,它立马刷屏全体AI圈。在编程、复杂逻辑推理和工程任务上的表现,让它带给业界深深的震撼。

然而,随着越来越多人加入实测,一场舆论风暴也在掀起——Anthropic,在背着我们让Fable 5偷偷降智!


知名 AI 学者、人工智能政策专家 Nathan Lambert 发表长文,尖锐地指出:如果你进行前沿技术查询,Anthropic就会在后台干预,让Fable 5「暗箱降智」。


他痛批道:「一个AI模型在不通知用户的情况下自动降低智能水平,这绝对是错误的人工智能。」

更夸张的是,有中文用户发现,仅仅对Fable 5说了一句「你好」,系统就弹出了高危安全警告。

一向以安全可信赖自居的Anthropic,背后居然偷偷搞暗箱操作、数据双标这一套?

现在,开发者社区已经群情激愤了:Anthropic,你到底在害怕什么?


Fable 5怕你问前沿技术,是为了防蒸馏?

Nathan Lambert发现,当你向Fable 5询问预训练管线、分布式训练架构、AI芯片设计等前沿技术问题时,它就偷偷摸摸地变笨了。

它不会拒绝回答,不会切换到低版本模型,更不会弹出任何提示——它只会默默降低回答质量,用更模糊、更浅薄、更不专业的语言敷衍你。

而这一切,完全发生在黑箱之中。

这是为什么?

Nathan Lambert在长文博客中揭露:A厂这么做,主要就是为防止竞争对手利用Fable 5进行模型蒸馏。


这样,就能保护自身的商业护城河,延缓其他开发者追赶的速度。

显然,投入了数十亿美元研发资金,还背负着巨大商业变现压力的A厂,是坚决不想让自家模型变成别人免费的教师模型。

所以,他们选择将所有用户都视作潜在的窃贼。

那些在高校、非营利机构中真正致力于研究大模型预训练、分布式优化、芯片硬件协作的科研工作者,也都被一棍子打死。

Lambert 悲哀地写道:「我个人无法再信任这个世界上最强大的 AI 模型能够用于我构建模型的专业领域。而我构建模型,完全是出于确保社会向强大 AI 系统安全过渡的热情。这不可避免地让人觉得,这是Anthropic单方面宣布的技术优越权。」

Anthropic的垄断,进一步巩固了。


为什么要暗箱降智?

根据官方公布的系统卡,Anthropic 将安全干预手段分为了两类。

第一种,是显性降级。

当用户输入的请求涉及到网络安全、生物和化学危险品、或特定的模型蒸馏时,Fable 5 的后台分类器会迅速做出判断。

一旦触发红线,系统会自动将当前的对话模型切换为 Claude Opus 4.8,并在前端界面明确告知用户。

虽然这种「显性降级」有些令人不快,但由于公开透明,因此并未引发太大争议。

真正点燃学术界怒火的,是针对前沿 AI 开发技术的第二类干预机制——隐性降智。

系统卡中写道:

我们对加速整体 AI 发展步伐的风险感到担忧……特别是,我们担心加速其他 AI 开发者构建强大的 AI 系统,而他们未必拥有相匹配的安全防护措施。

因此,我们实施了新的干预措施,限制 Claude 在针对前沿大模型开发(例如构建预训练管线、分布式训练基础设施或机器学习加速芯片设计等)请求时的有效性。

最关键的差异在于:「与网络安全或生物化学的干预不同,这些针对前沿 AI 开发的保护措施对用户是不可见的。Fable 5 不会降级到其他模型,而是会通过提示词修改、转向向量或参数高效微调等方法,暗中限制模型的输出质量。」

也就是所谓的「静默降智」。


如果你问到分布式训练集群、设计ML芯片架构这类问题时,你会得到被可以被刻意注入了干扰向量的阉割版回答。

而这一切,Anthropic 决定完全不告知用户。

学者 Nathan Lambert 对此撰文进行了猛烈抨击。他认为,这种行为就是「人为制造的对齐失调」。

本来,对齐是为了让 AI 的行为符合人类的意图和福祉。而 Anthropic 的做法,完全是反其道而行之。

Lambert 警示道,「沿着这条路走下去,下一步——虽然 Anthropic 现在还没这么做,但他们完全有能力做到——就是当模型认为某个工作场所的 AI 应用不安全时,在后台静默地操纵、干扰该工作场所的业务运行。」

神经质防守:说句「你好」就触发警报

更夸张的是,有中文用户晒出截图:在刚刚打开对话框,仅仅向 Claude Fable 5 发了一句 「你好」,就突然出现高危安全警告:「您的请求触发了高危安全策略过滤……」


显然,在后台算法看来,这一句你好说不定是经过精心伪装的探针攻击。

一旦触发了这一机制,Fable 5 会立刻单方面掐断当前的对话,强制将用户切回上一代的 Opus 4.8。


这种「宁可错杀一千,绝不放过一个」的极端策略,让大批普通用户哭笑不得。

似乎在 Fable 5 眼里,任何可疑的输入,都像是在合成生物武器或者反向蒸馏它的知识产权。

随后,Anthropic 官方承认:「全新的安全过滤机制在极高强度的防御策略下,确实可能会频繁误伤正常内容。」

开源的反击:开源是唯一的答案

就在Fable 5发布引发争议的前一周,NVIDIA发布了其首款旗舰开源模型—Nemotron 3 Ultra。

这个时间点耐人寻味。

Lambert在文中直言:

过去一周可以被视为美国新兴开源生态系统的一个重要转折点。Anthropic的举措激发了我们这些构建开源模型的同行们的一致动力。

为什么开源模型突然变得更有吸引力?

答案很简单:它不会对你撒谎。

当你在本地运行开源模型时,你知道它的全部权重、全部参数、全部行为逻辑。没人能在后台暗箱操作。

Llama、DeepSeek、Qwen、Nemotron提供了一个闭源模型永远无法提供的东西:可验证的信任。

在文章最后,Lambert给出了一个更深层的判断:

如此强大的技术,最终的平衡状态绝不可能由一家私营公司完全掌控。Anthropic今年早些时候与国防部的争端就说明了这一点——政府要么希望AI受其控制,要么希望AI保持开放。

这让我相信,开放的生态系统才是更安全的选择。

他的结论是:Anthropic正在犯错。他们试图用封锁和对抗来保护自己的领先地位,但这只逼迫更多人转向开源。

Claude Fable 5确实在技术上有了惊艳的飞跃,但它在伦理上的退步,或许会成为AI发展史上的一个警醒。

当一家公司开始以安全之名对用户撒谎时,信任的裂缝就再也无法弥合。

参考资料:

https://x.com/natolambert/status/2064412173527556298

编辑:Aeneas

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
反转!母亲证实雅典娜没死,潮汕商会曝猛料,网友:这比死还难受

反转!母亲证实雅典娜没死,潮汕商会曝猛料,网友:这比死还难受

李橑在北漂
2026-08-12 20:47:59
牡丹花下死?古柯再曝刘晓庆猛料,庆奶发声,没把前助理放眼里

牡丹花下死?古柯再曝刘晓庆猛料,庆奶发声,没把前助理放眼里

汪镛的创业之路
2026-08-11 17:55:59
悬案告破!香港“霞姐”遭多名男子乱刀砍杀,幕后真凶曝光......

悬案告破!香港“霞姐”遭多名男子乱刀砍杀,幕后真凶曝光......

港漂圈
2026-08-12 21:23:58
我发现一个可怕的事,76%的年轻男性,都不怕女方“不生娃威胁”了,开始破罐子破摔

我发现一个可怕的事,76%的年轻男性,都不怕女方“不生娃威胁”了,开始破罐子破摔

舒山有鹿
2026-08-10 11:14:09
医生发现:大量喝茶的糖尿病患者,用不了多久,身体或有5大变化

医生发现:大量喝茶的糖尿病患者,用不了多久,身体或有5大变化

任医生聊健康
2026-08-12 20:50:07
2026暑期档票房破90亿,《功夫女足》竟力压《八仙》夺冠

2026暑期档票房破90亿,《功夫女足》竟力压《八仙》夺冠

报错免疫体
2026-08-12 19:28:28
国乒最强铁人诞生!蒯曼7小时鏖战三场,凭超强意志锁死一姐位

国乒最强铁人诞生!蒯曼7小时鏖战三场,凭超强意志锁死一姐位

小小科普员
2026-08-12 20:08:33
太意外了!2032奥运举办地敲定:结果惊呆众人,奥运格局大变!

太意外了!2032奥运举办地敲定:结果惊呆众人,奥运格局大变!

小涛叨叨
2026-04-22 17:06:20
最被低估的政治力量

最被低估的政治力量

维舟
2026-08-12 19:30:54
不得了,伊朗不装了!正式向全球宣布一件事,美以这下进退两难了

不得了,伊朗不装了!正式向全球宣布一件事,美以这下进退两难了

地球记
2026-08-12 08:29:17
北大化学才女李天乐,潜伏在顶级药企工作十年,她利用职务之便领取铊,将清华丈夫一点点“熬”死在病房

北大化学才女李天乐,潜伏在顶级药企工作十年,她利用职务之便领取铊,将清华丈夫一点点“熬”死在病房

人生录
2026-07-30 00:05:08
价值15亿长征七号改运载火箭中星4B卫星发射失败!安全天数清零!

价值15亿长征七号改运载火箭中星4B卫星发射失败!安全天数清零!

大稻网络科技
2026-08-11 01:21:23
中国导演不配拍战乱?《欢迎来龙餐馆》差评引众怒

中国导演不配拍战乱?《欢迎来龙餐馆》差评引众怒

3DM游戏
2026-08-12 18:19:32
韩国宣布:不向乌克兰供武

韩国宣布:不向乌克兰供武

上观新闻
2026-08-11 12:15:00
小米回应海外空调“精致安装”能否引入国内 已发起调研

小米回应海外空调“精致安装”能否引入国内 已发起调研

CNMO科技
2026-08-10 21:12:06
触目惊心!南太行22岁程梦圆坠亡,多张现场图复盘:她离张良庙的平地非常近了

触目惊心!南太行22岁程梦圆坠亡,多张现场图复盘:她离张良庙的平地非常近了

火山詩话
2026-08-11 12:01:11
公安部定死“三个当场”,当场要回执,不给你就握住了翻盘底牌

公安部定死“三个当场”,当场要回执,不给你就握住了翻盘底牌

水泥土的搞笑
2026-08-12 12:36:19
手机从2700米高空摔进怒江大峡谷:靠华为云空间查找功能精准找回

手机从2700米高空摔进怒江大峡谷:靠华为云空间查找功能精准找回

快科技
2026-08-12 18:50:15
震惊了!坐飞机,发现了一名超像豆包的空姐

震惊了!坐飞机,发现了一名超像豆包的空姐

微微热评
2026-06-25 12:35:51
罕见:演员贾冰被偷拍,连官媒也看不下去了!

罕见:演员贾冰被偷拍,连官媒也看不下去了!

仕道
2026-08-11 10:07:56
2026-08-12 23:11:00
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
15925文章数 66999关注度
往期回顾 全部

科技要闻

Manus第二季,浪子回头

头条要闻

业主称天然气公司要求热水器满8年必须换 不换不能购气

头条要闻

业主称天然气公司要求热水器满8年必须换 不换不能购气

体育要闻

杜兰特,所谓的“联盟小王”

娱乐要闻

老戏骨杨昆两夺金鹰奖,因物业费被告

财经要闻

华尔街把AI算力炒成下一个房地产?

汽车要闻

这台大众不一般 上汽大众ID.ERA.5S综合续航约2000公里

态度原创

数码
本地
亲子
公开课
军事航空

数码要闻

内存狂涨推高老旧处理器销量 旧型号倒反天罡力压旗舰

本地新闻

黄州一夜,苏轼写给普通人的月光

亲子要闻

快来跟我一起上声乐课吧~ #vlog日常#少儿声乐#唱歌#彩虹糖裴曼伊

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

通过“毕业大考” 湖北舰“持证上岗”

无障碍浏览 进入关怀版