研究员|卢杨
北京时间9月2日,Anthropic静悄悄上线了Claude Fable 5.1和Mythos 5.1。
![]()
毫无疑问,这又是一次世界级模型的亮相:8项公开基准测试全部第一,缓存读取价格从每百万token 1美元直降到0.25美元、降幅75%,典型工作负载总成本降低约25%、高度智能体化任务最高省45%:单看这些,这不过一次顶级模型的常规迭代:更强、更快、更便宜。AI圈每月都在发生这种事。
但我们要说的,藏在不起眼的角落里:
01
反蒸馏机制,正式落地
Anthropic给“思维链”上了把锁。
从今天起,新注册的API账号不能再在多轮对话里手动篡改Claude的上下文、同时保留它的推理过程。每个思维链区块都被打上了数字签名,对话前缀有任何改动:哪怕一句系统提示词、一个工具、一条历史消息,签名就失效。API要么报400错误,要么静默丢弃被篡改的区块。
![]()
巧合的是,一个月前,张一鸣在字节内部说了一句话:字节不做蒸馏,即使短期落后。当时争议很大。一个月后,Anthropic的反蒸馏落地了。
我们来说说蒸馏是什么。
2015年Hinton提出以来,蒸馏就是AI行业的常规操作:用一个强大的“教师模型”训练一个更小的“学生模型”,让学生花更少的钱获得接近老师的水平。美国公司互相用,行业常态,心照不宣。
但Anthropic这次高调地用技术手段把它堵上了。他们给出的理由是“因为蒸馏能力随后可以在没有充分保障的情况下释放。”此前Anthropic已多次公开指控外来公司进行“工业级蒸馏攻击”,这次上技术锁,也算是把之前的口水仗落到了实处。
反蒸馏最核心的就一条:思维链不能碰了。
思维链为什么关键?因为它是推理过程。最终输出是答案,思维链是解题步骤。蒸馏最有效的方式,就是拿这些“解题步骤”去训练小模型。
Anthropic给每个思维链区块都加了数字签名。对话前缀有任何改动,签名就失效。处理方式有两种:默认返回400错误拒绝请求;或者静默丢弃被篡改的区块,请求照常执行,丢弃部分不计费。
这是一把逐级收紧的锁。目前只针对8月31日后注册的新账户,但Anthropic已放话:未来所有新模型都会强制执行。
有些操作是安全的:在对话末尾追加新消息、移除开头的思维链区块、改max_tokens这类参数、服务端压缩上下文,这些不会触发校验。但文档里特别提醒:如果你维护的工具让用户用自己的API密钥调用,新注册用户会更早撞上校验,最好提前测试。
也就是说,如果用Claude Code或Claude.ai这些官方产品,什么都不用改。直接调API的话,官方建议把messages数组严格当“只追加”来用。
这把锁落下的时机,也印证了8月初张一鸣的判断。
02
成绩单:8项第一,断层式领先
聊完反蒸馏,再来看看Anthropic这次到底发布的产品性能如何。
![]()
在Anthropic公布的8项评测中Fable 5.1依旧是碾压级的存在。Fable 5.1在Terminal-Bench-Science 0.1(智能体科研基准)上拿下52.6%。作为对比,上一代Fable 5只有24.7%,Claude Opus 5为29.0%,GPT-5.6 Sol只有22.4%:新模型是它们的两倍多。
在Terminal-Bench 4.0(智能体编程测试)上,Fable 5.1达到55.8%,Mythos 5.1更是飙到60.9%。上一代Fable 5仅为42.0%,GPT-5.6 Sol为37.3%。
CursorBench 3.2.0上,Fable 5.1以73.4%刷新内部纪录。AutomationBench(商业工作流)从上一代的17.1%跃升至31.4%,几乎翻倍。在OSWorld 2.0(计算机使用基准)上,Fable 5.1达到77.9%(宽松标准)和41.7%(严格标准)。GDPval-AA v2(知识工作基准)拿下1853分,同样领先Fable 5的1723分和Opus 5的1824分。Humanity's Last Exam(多学科推理)无工具模式下60.9%,启用工具后提升至65.0%。
还有一个容易被忽略的细节:把Fable 5.1的推理程度调到“低”或“中”,表现已经达到甚至超过老版Fable 5开到最高推理程度的效果。
价格方面,输入输出价格与Fable 5保持一致(输入10美元、输出50美元每百万token),但缓存读取从1美元降到0.25美元,降幅75%。为什么降这个?因为智能体任务里缓存读取占了成本大头。Anthropic算了一笔账:普通工作负载总成本降25%,重度Agent任务最多省45%。对于那些需要频繁读写上下文的复杂Agent应用,这意味着成本结构的大幅优化。
跑分之外,Anthropic还展示了三个让人无法忽视的充满“科研色彩”的实战案例。
03
亲自做科研:重绘金星、
设计蛋白、手写GPU内核
重绘金星。30多年前NASA麦哲伦号拍的金星雷达图像,分辨率只有10到20公里。过去人类只把其中五分之一做成了高程图。Fable 5.1自己训练了一个神经网络,重新生成了覆盖金星约三分之一表面的高分辨率地形图,分辨率推进到2到3公里,高度精度提升25%。地图已以CC协议开源发布,供NASA VERITAS和ESA EnVision任务参考,帮助确定未来观测的重点地质特征。
设计蛋白质,命中率逼近50%。Mythos 5.1用开源工具设计高亲和力结合蛋白:这是很多药物开发的起跑线,决定了药物能否在低剂量下起效。设计方案送到外部实验室做湿实验。结果:在EGFR、Nipah G等三个靶点上,结合亲和力是Adaptyv Bio竞赛最佳方案的10倍。12个靶标总体命中率接近50%,而行业平均水平只有10%到15%。
手写GPU内核,生物模型提速2.5倍。Mythos 5.1用几天时间,为7个开源生物模型:包括Evo 2、ProGen2等,手写自定义GPU内核并缓存中间结果,推理速度最高提升2.5倍,输出完全一致。针对全基因组分析,预估GPU算力成本可降低30%至60%。这种活通常需要专业性能工程师团队干好几周,很多学术实验室根本请不起。
还有一个关于长程稳定性的例子值得一提。投资公司Millennium内部有一个罕见的崩溃Bug,大概跑一百万次才崩一回,整个团队追了四五年都没找到根因。Fable 5.1接手后,直接反汇编了一个第三方库,对照核心转储文件,一路追到外部依赖的漏洞,然后把锅甩得干干净净。Anthropic管这叫“不会半路撂挑子”:真到40步的长任务里,每一步微小的偏差都可能导致全盘崩溃,而Fable 5.1就是能稳住。
04
安全方面也有大动作
说完性能和科研,再聊聊安全。这次Anthropic在护栏上做了几项调整,有收有放。
放的是误报率降下来了。以前程序员拿Claude自查代码,动不动就被当成黑客拦截,搞得人很崩溃。现在Fable 5.1终于放开了,允许用于发现软件漏洞,做防御性工作。网络安全误报率比Fable 5降了60%。基础生物学和医学问题的误报率据媒体报道也降了85%,普通用户问点健康相关的问题,不会再动不动被拦。Mythos 5.1能够设计高亲和力结合蛋白,但Anthropic并没有把完整生物能力向所有用户开放:涉及研发的查询仍然路由到Opus模型,真正需要完整能力的专业人员得通过生命科学验证计划申请,这个计划是与美国政府合作的,目前只对通过审核的美国机构开放。
收的是发现漏洞可以,写攻击代码不行。 渗透测试、漏洞利用生成、基于二进制的漏洞扫描这类双重用途任务,全部被重定向到Opus系列模型处理,Fable 5.1碰都不让碰。
还有一个是企业数据归属权做了调整。 新推出的Enterprise Frontier Safeguards让客户把数据存在自己的云上(AWS、Google Cloud、Azure都支持),而不是Anthropic的服务器。数据审查默认由客户自己做,Anthropic不碰。相当于企业客户在享受“零数据留存”级别的隐私保护的同时,Anthropic依然能通过技术手段防止模型被滥用。EFS今年秋天开始分阶段推出,在此之前符合条件的客户可以直接用零数据留存政策使用Fable 5.1。
Anthropic这次发布,加上反蒸馏这把锁,让绝大部分模型厂商面临一个越来越紧迫的选择:
蒸馏短期或许还是有效的追赶手段。只要你能拿到顶级模型的输出,就能用更低的成本“模仿”出接近的性能。但长期来看,这条路正在收窄。Anthropic是第一家。
不能蒸馏了。张一鸣赌对了。
编辑|邱慧 张猛
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.