网易首页 > 网易号 > 正文 申请入驻

中国模型加速AI明星“内卷”,Anthropic上新Claude Opus 5,性能逼近Fable 5,价格打对折

0
分享至

在中国新模型持续以低价和高性价比冲击市场、企业客户也开始重新审视AI支出的背景下,Anthropic率先将“降本增效”推向了高端模型市场。

美东时间24日周五,Anthropic发布新一代Claude Opus模型Opus 5,称其在多个任务上的性能已经逼近公司最先进的Fable 5,但API价格只有后者的一半。Anthropic预计,Opus 5将成为企业日常办公、软件开发、科学研究和AI智能体工作流中的默认模型,称它是Claude Max的默认模型,也是Claude Pro平台的最强模型。

Anthropic此次“上新”意味着,AI模型的价格战正在进入新阶段:竞争焦点不再只是推出更强大的旗舰模型,而是如何将接近旗舰级的能力以更低成本大规模部署。因为Opus 5并不是一个单纯的便宜模型,而是试图将接近旗舰级的能力下沉到更广泛的企业日常任务。

媒体评论称,Anthropic的劲敌OpenAI、Meta等大举投入AI的硅谷公司也在加快推出更具成本效率的模型,而中国AI公司则通过低价和开放权重模型进一步加剧了这一竞争。

当中国模型以低价追赶、企业客户开始重新计算AI投入产出比,AI行业的下一场竞争可能不再是“谁能训练出最强模型”,而是:谁能以最低成本提供足够强的模型。

Opus 5某些测试成绩接近或超过Fable 5 成本远低于后者

Anthropic此次对Opus 5的定位并非“绝对旗舰”,而是一个面向大规模使用的高性能通用模型。

公司称,Opus 5在软件工程、知识工作和复杂问题解决等多个测试中达到行业领先水平,同时以与上一代Opus 4.8相同的价格提供服务。

在软件工程方面,Anthropic称,Opus 5在Frontier-Bench测试中超过其他模型,表现较Opus 4.8翻倍以上;在CursorBench 3.2测试中,Opus 5最高努力等级下的成绩距离Fable 5峰值仅相差0.5%,但单任务成本只有后者的一半。

在知识工作和自动化任务方面,Opus 5同样表现突出。Anthropic称,在ARC-AGI 3测试中,其得分约为下一名模型的3倍;在Zapier AutomationBench中,以相同任务成本计算,其通过率约为下一名模型的1.5倍;在OSWorld 2.0电脑操作测试中,Opus 5以略高于Fable 5三分之一的成本,超过了Fable 5的最佳成绩。

Anthropic还强调,Opus 5在科学研究任务上的能力明显提升,尤其是在有机化学和蛋白质相关任务上。

从价格来看,Opus 5的API价格为每百万Token输入5美元、输出25美元,与Opus 4.8相同。而Anthropic当前旗舰模型Fable 5的定价为每百万Token输入10美元、输出50美元。

换言之,Anthropic正在尝试提供一种新的产品组合:接近旗舰级的能力,但价格只有旗舰模型的一半。

从代码开发到科学研究:Opus 5到底强在哪里?

Opus 5的一个重要变化,是Anthropic开始强调模型的“计算效率”,而不仅仅是最终答案的质量。

公司称,新模型能够更好地检查自己的工作、发现逻辑错误并反复迭代。在部分测试中,Opus 5达到类似表现所需的推理Token数量明显低于上一代。

这意味着,模型能力提升的衡量标准正在发生变化。

过去,模型之间的竞争主要看谁能够在Benchmark上取得更高分;如今,对于企业客户而言,另一个问题同样重要:完成同一个任务,模型到底需要消耗多少Token?

在软件工程场景中,Opus 5重点提升了代码理解、代码修改和复杂任务执行能力。Anthropic称,模型在相关测试中的表现大幅超过上一代,并且在接近Fable 5能力的情况下显著降低了单项任务成本。

在知识工作和自动化领域,Opus 5则瞄准了企业日常流程。

从处理文档、分析信息,到调用工具、操作电脑和执行多步骤任务,模型的目标不再只是生成一段文本,而是完成一个完整的工作流程。

Anthropic称,在ARC-AGI 3、Zapier AutomationBench和OSWorld 2.0等测试中,Opus 5均表现出较强的任务执行能力。

在科学研究方面,Anthropic称,Opus 5在有机化学任务上的得分较Opus 4.8提高10.2个百分点,在预测蛋白质序列变化影响方面提高7.7个百分点。

这意味着,Anthropic正在将Opus 5从一个“更强的聊天模型”推向一个更广泛的专业工作工具。

模型越强,安全边界越重要:网络安全能力接近Mythos 5

随着模型能力提升,Opus 5的网络安全能力也成为此次发布的重要看点。

Anthropic称,Opus 5在发现软件漏洞方面的能力已经接近更高阶的Mythos 5,但在将漏洞转化为实际攻击工具方面仍明显落后。

公司同时强调,和上一代Opus 4.8一样,Opus 5并未针对网络安全任务进行专门训练。

Anthropic表示,模型在网络安全任务上的能力提升,主要源于其通用能力增强。

在安全限制方面,Anthropic称,Opus 5的安全分类器相比Fable 5“明显更宽松”,安全机制的干预次数将大幅减少,但仍会阻止二进制漏洞扫描、渗透测试和漏洞利用代码生成等高风险任务。

这一变化反映出AI模型能力提升带来的两面性。

一方面,模型需要具备足够强的能力,才能真正用于企业网络安全、科学研究和复杂工程任务;另一方面,模型越强,如何控制其在高风险领域的使用边界也越困难。

因此,Anthropic此次发布Opus 5,实际上不仅是在降低模型价格,也是在探索如何让更强大的模型以更少的安全限制进入真实工作场景。

AI行业开始重新计算“每个Token的价值”

Opus 5发布的背后,是企业客户对AI支出回报率越来越强烈的关注。

报道称,一些企业客户已经因为AI支出快速增加而收紧员工使用限制,并重新评估AI工具的投入产出比。

Anthropic负责研究产品管理的Dianne Penn表示,公司正在回应企业客户关于“如何创造更多价值”的反馈。

这说明,AI行业正在进入一个新的阶段。

在早期阶段,企业客户更关注一个模型是不是全球最强?而当AI开始进入企业日常工作流程后,企业开始关注:完成同一个任务,我为什么要多花一倍的钱?

这也使得模型的实际成本变得越来越重要。

一个模型即使在Benchmark上领先,如果完成同样任务需要消耗更多Token,最终的企业使用成本也可能更高。

反过来,一个性能略低但推理效率更高、价格更便宜的模型,可能更适合大规模部署。

于是,AI行业的竞争指标正在从单一的模型能力,变成:模型能力 × 推理效率 × 单位成本。

Opus 5正是Anthropic针对这一变化推出的产品。

中国模型不断“卷”价格 美国AI巨头被迫提高性价比

如果说企业客户的成本压力推动了AI模型价格重新评估,那么中国AI模型的竞争则进一步加速了这一过程。

7月16日上周四,月之暗面正式发布2.8万亿参数的全球最大开源模型Kimi K3,已公布的测评结果显示,该模型的整体能力仅落后于Fable 5和OpenAI的GPT-5.6。

DeepSeek此前也已经通过低价策略和开放权重模式,推动全球AI模型价格持续下探。

中国模型的竞争意义不一定在于已经在所有前沿能力上超越美国顶级模型,而在于它们正在改变市场对AI模型价格的预期。

过去,企业可能接受“更强的模型就该更贵”这种说法,可是,随着越来越多高性能模型以更低价格提供服务,这种价格逻辑正在发生变化。

如果一个更便宜的模型已经能够完成企业80%甚至90%的日常任务,那么客户是否还愿意为剩余的性能差距支付两倍甚至数倍的价格,就成为现实问题。

这也是Anthropic、OpenAI、Meta等公司都在加快推进更具成本效率模型的原因之一。

从这个角度看,中国模型的竞争与企业自身的降本压力正在形成叠加效应。

一边是中国模型不断以低价追赶,另一边是美国企业客户开始要求AI投入产生更高回报。两股力量共同推动全球AI模型市场重新计算“性能究竟值多少钱”。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
俄罗斯的命脉并不在俄罗斯,俄罗斯的死穴只有一个,就是中国

俄罗斯的命脉并不在俄罗斯,俄罗斯的死穴只有一个,就是中国

叶葉夜
2026-07-27 15:44:26
个人贷款新规!8月1日起正式施行

个人贷款新规!8月1日起正式施行

云安融媒
2026-07-29 13:09:14
不幸的消息传来!乌克兰出大事了!

不幸的消息传来!乌克兰出大事了!

故事终将光明磊落
2026-07-28 12:26:31
勿与傻逼论短长:帅翔云阴茎不到两厘米不是犯罪理由。

勿与傻逼论短长:帅翔云阴茎不到两厘米不是犯罪理由。

作家方晓莉
2026-07-30 01:09:04
税务部门公布3起内外勾结案件 税务人员与不法分子通同作弊 最高获刑十三年

税务部门公布3起内外勾结案件 税务人员与不法分子通同作弊 最高获刑十三年

每日经济新闻
2026-07-30 01:26:55
深不见底!牛津研报揭开:不抢油的中国,比抢油的中国,更可怕!

深不见底!牛津研报揭开:不抢油的中国,比抢油的中国,更可怕!

陌上桃花开的
2026-07-29 10:40:36
笑不活了!如果你不开心,就去看看那英吐槽冉莹颖败家的网友评论吧,快笑趴了

笑不活了!如果你不开心,就去看看那英吐槽冉莹颖败家的网友评论吧,快笑趴了

娱乐圈笔娱君
2026-07-28 17:59:49
新官上任三把火!63岁穆里尼奥二进宫皇马,4新援已落地+2巨星冲刺中,阿森西奥卡马文加领衔清洗,恩德里克恐再外租

新官上任三把火!63岁穆里尼奥二进宫皇马,4新援已落地+2巨星冲刺中,阿森西奥卡马文加领衔清洗,恩德里克恐再外租

锐评利物浦
2026-07-29 11:04:34
41岁《邻家女孩》女星穿红色比基尼秀身材,用GLP-1三个月从10码降到6码

41岁《邻家女孩》女星穿红色比基尼秀身材,用GLP-1三个月从10码降到6码

生活观察员啊
2026-07-30 01:36:04
周笔畅被吐槽缺乏性张力,陈奕迅微表情亮了

周笔畅被吐槽缺乏性张力,陈奕迅微表情亮了

木子爱娱乐大号
2026-07-28 17:29:20
国际油价,大幅下跌!

国际油价,大幅下跌!

上观新闻
2026-07-29 06:26:38
可怜天下父母心,上海名嘴脸颊凹陷嘴角歪斜,还为天价学费带货?

可怜天下父母心,上海名嘴脸颊凹陷嘴角歪斜,还为天价学费带货?

不似少年游
2026-07-29 16:34:33
虎鲸为何6年撞沉至少8艘船?科学家推测可能与社会学习有关,并非报复

虎鲸为何6年撞沉至少8艘船?科学家推测可能与社会学习有关,并非报复

冷知识挖掘机21
2026-07-29 00:16:00
【2026.7.29】爆姐的饭后爆料:生命不止,爆料不息!

【2026.7.29】爆姐的饭后爆料:生命不止,爆料不息!

娱乐真爆姐
2026-07-30 00:34:05
强援震撼加盟火箭!这下不仅雷霆,掘金也要紧张了

强援震撼加盟火箭!这下不仅雷霆,掘金也要紧张了

宝哥精彩赛事
2026-07-29 01:52:54
雷军预热小米澎程N90 Max 后车门90度开合可塞两辆公路车

雷军预热小米澎程N90 Max 后车门90度开合可塞两辆公路车

泡泡网
2026-07-29 11:45:21
骑士连失哈登詹姆斯,火速更新引援名单抢人

骑士连失哈登詹姆斯,火速更新引援名单抢人

林子说事
2026-07-29 08:53:48
台湾退役中将帅化民表示:不少人都说中国军事力量已居世界顶尖水平,但在他看来,真正需要思考的不是先打谁,而是大陆为何始终隐忍不出手

台湾退役中将帅化民表示:不少人都说中国军事力量已居世界顶尖水平,但在他看来,真正需要思考的不是先打谁,而是大陆为何始终隐忍不出手

人生录
2026-07-27 00:05:06
令人作呕!新京报记者暗访曝光“酸臭毛粉”黑色产业链,引发全网震动

令人作呕!新京报记者暗访曝光“酸臭毛粉”黑色产业链,引发全网震动

火山詩话
2026-07-29 11:40:50
海蒂·克鲁姆穿丁字裤比基尼晒日光浴,推广薯片被赞“最佳零食”,自曝拒绝减肥针:老公说我胖点更美

海蒂·克鲁姆穿丁字裤比基尼晒日光浴,推广薯片被赞“最佳零食”,自曝拒绝减肥针:老公说我胖点更美

赴一场山海啊
2026-07-30 00:03:07
2026-07-30 02:04:49
华尔街见闻官方 incentive-icons
华尔街见闻官方
中国领先的金融商业信息提供商
149880文章数 2654321关注度
往期回顾 全部

科技要闻

Kimi K3火爆,奥特曼:开源一定有一席之地

头条要闻

男女酒后驾车坠河身亡女子家属索赔近200万 法院判了

头条要闻

男女酒后驾车坠河身亡女子家属索赔近200万 法院判了

体育要闻

毫无存在感的NBA状元,最先谢谢惠顾?

娱乐要闻

55岁影帝黄政民出轨

财经要闻

天丝红牛多地检出成分不合格 企业申诉

汽车要闻

MG 07预售12.59万起 高阶版配激光雷达+CDC

态度原创

旅游
数码
手机
游戏
公开课

旅游要闻

小学课本里的威尼斯,长大后才看见另一半

数码要闻

苹果又出新招?一件即可操控所有苹果设备

手机要闻

实锤了!华为nova16 SE真机外观曝光:不仅撞脸荣耀,这颜值你打几分?

外媒破防索尼取消实体盘:玩家失去“捡漏”机会

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版