![]()
2026 年 9 月 2 日,Anthropic 发布新一代旗舰模型 Claude Fable 5.1,并同步调整 Messages API 对模型“思考块”的处理方式。
针对新创建的 API 账户,开发者今后无法在保留原有思考块的同时,修改产生这些思考内容之前的消息、工具或系统提示。
Anthropic 表示,此举主要用于阻止未经授权的大规模模型蒸馏。
Claude Fable 5.1 已正式发布,被 Anthropic 定位为目前能力最强的通用 Claude 模型,主要面向编程、知识工作以及长时间运行的 Agent 任务。
Fable 5.1 与同期推出的 Mythos 5.1 使用相同底层模型。
区别主要在安全限制:
1)Fable 5.1 面向普通用户和开发者开放,并针对网络安全、生物等高风险领域加入额外保护;
2)Mythos 5.1 则主要向经过审核的网络安全和生命科学机构开放。
在性能方面,Anthropic 公布的测试数据显示,Fable 5.1 在 Terminal-Bench-Science 0.1 上取得 52.6% 的成绩,高于 Fable 5 的 24.7%、Opus 5 的 29.0% 和 GPT-5.6 Sol 的 22.4%;在 Terminal-Bench 4.0 Agent 编程测试中取得 55.8%,Fable 5 和 Opus 5 分别为 42.0% 和 52.3%。
![]()
Anthropic 将其定位为适合跨代码库开发、代码审查、复杂知识工作以及持续数小时甚至数天的自主任务。
Fable 5.1 的 API 输入价格为每百万 Token 10 美元,输出为 50 美元,与上一代 Fable 5 的基础价格保持一致。
缓存读取价格降至每百万 Token 0.25 美元,较 Fable 5 下降 75%。Anthropic 预计,一般任务综合成本可以下降约 25%,Agent 密集型任务最高下降约 45%。
Anthropic 展示了 Fable 5.1 在生物与基因组模型优化上的表现,在 NVIDIA H100 上,7 个开源蛋白质与基因组模型的推理速度均高于原始实现,提升幅度约为 1.4 倍至 2.5 倍。其中,ProGen2 的提升最高,达到 2.5 倍;Flashzoi 提升 1.8 倍;ChromBPNet、Profluent-E1 和 Evo 2(7B)均提升 1.6 倍;Enformer 和 Evo 2(40B)提升 1.4 倍。
![]()
伴随新模型上线,Anthropic 对 Messages API 加入了一项新的“保留思考”规则。
Claude 在生成最终回答之前可能产生一系列内部推理步骤,这些内容通过 API 以“思考块”的形式返回。
在多轮对话中,开发者通常会将此前生成的思考块,与历史消息、系统提示和工具定义一起再次发送给 Claude,让模型继续处理之前的任务。
按照新的规则,对于受影响的 Fable 5.1 API 账户,Anthropic 会检查一个思考块是否仍然与最初产生它时的系统提示、工具和历史消息保持一致。
如果开发者修改了该思考块之前的系统提示、工具配置或者消息内容,同时继续提交原来的思考块,API 将直接返回错误。
过去可以采用“修改历史上下文,同时保留原有模型推理”的调用方式,现在开始受到限制。
Anthropic 将这一改动直接指向大规模非法模型蒸馏。
Anthropic 表示,修改早期对话本身存在正常用途,例如压缩长对话、调整系统提示或者改变工具配置,但这种方法同时也是未经授权提取先进模型能力的一种常见技术。
部分蒸馏操作者会利用数千个虚假账户调用先进模型,并收集模型产生的推理过程,再用这些数据训练其他模型。
Anthropic此前已经对 Claude 的思考块进行加密,但攻击者可以修改思考块之前的对话内容,诱导 Claude 解密并重新输出此前的推理。
Anthropic认为,通过这类方法训练的新模型可能获得原本不具备的高级推理能力,却不会同步继承 Claude 针对网络攻击、武器开发等高风险用途部署的安全措施。
此次调整因此并非简单隐藏模型思考,而是将思考块与产生它的历史上下文绑定。开发者可以继续使用思考块,但不能任意改变它之前发生过的内容。
对于确实需要修改历史消息的开发者,Anthropic 仍提供兼容方案。
开发者可以选择使用非严格模式。
在这种情况下,即使历史上下文发生变化,请求仍可以继续执行,但与新上下文不匹配的思考块会被删除,Claude 将在看不到这些旧推理的情况下继续生成回答。API 响应会同时告诉开发者哪些思考块被移除。
这一变化可能影响部分 Agent、长上下文以及自动压缩对话的应用。
例如,一些 AI 应用会在对话持续变长后删除旧消息、重新总结早期内容,或者动态修改系统提示和工具配置。如果这些操作发生在已有思考块之前,原有思考块将无法继续原样使用。
Anthropic 建议开发者尽量保持历史消息、工具和系统提示不变,并采用新的兼容机制处理需要调整上下文的任务。保持思考块对应上下文稳定还可以增加 Prompt Cache 的复用率,降低 API 成本和响应时间。
此次限制目前并非覆盖所有 Claude 用户。
Anthropic 表示,在 Fable 5.1 上,新规则首先适用于 2026 年 8 月 31 日及以后创建的新 Claude Platform 组织、Amazon Bedrock 账户、Google Cloud Vertex AI 项目和 Microsoft Azure Foundry 项目。
Fable 5.1 的现有 API 账户暂时不受影响,Claude Code、Claude Cowork、Claude.ai 以及通过第三方产品使用 Claude 的普通用户也不受此次调整影响,Fable 5.1 之外的其他 Claude 模型目前同样不适用该规则。
不过,Anthropic 已经明确表示,“保留思考”机制将在未来发布的 Claude 模型中扩展至所有 API 账户。
从 Fable 5.1 开始,Anthropic 正在把模型内部推理与产生这些推理的完整上下文绑定。模型推理不仅成为需要保护的内部数据,也开始成为 API 安全体系中的独立控制对象。
Anthropic 原文:
![]()
云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。
![]()
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.