Anthropic于今天凌晨正式推出了Claude Opus 5。官方称其为“深思熟虑且主动”的模型,它的智能水平接近 Claude Fable 5 的前沿能力,价格却只有后者一半。
![]()
在编程与知识工作评测中,Opus 5 成为新的SOTA(state-of-the-art),但在网络安全任务上仍落后于 Mythos 5。该模型即日起成为 Claude Max 默认模型,也是 Claude Pro 最强模型。
成本上,Opus 5 与 Opus 4.8 定价相同但性能大增:Frontier-Bench v0.1 超越所有模型,单位成本更低且性能超前者两倍以上;CursorBench 3.2 最高算力档得分与 Fable 5 仅差 0.5%,成本仅一半。ARC-AGI 3 得分是次优模型三倍,OSWorld 2.0 以约三分之一成本超越 Fable 5 最佳成绩。科研上其在生命科学评测全面优于 Opus 4.8,有机化学、蛋白质任务分别高出 10.2 和 7.7 个百分点。
![]()
安全层面,Opus 5 是 Anthropic 迄今对齐程度最高、最安全的模型,危险双用途能力未推进前沿,生物学与进攻性网络安全仍落后 Mythos 5;其网络分类器较 Fable 5 宽松,允许查漏洞但禁二进制扫描与漏洞利用生成。
定价上,Opus 5 输入每百万 token 5 美元、输出 25 美元,与 Opus 4.8 一致,另提供约 2.5 倍速的 Fast 模式。
随着新模型的推出,Anthropic 同步推出两项测试功能:一是 Claude Platform 上的对话中途切换工具,开发者可在不使提示词缓存(prompt cache)失效的情况下,于对话进行中更改 Claude 可调用的工具;二是 API自动回退,当 Opus 5(或 Fable 5)上被安全分类器标记的请求,可自动路由至另一模型而非直接阻断,开启后 API 请求默认始终路由至当前最优可用模型。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.