网易首页 > 网易号 > 正文 申请入驻

Anthropic深夜掀桌!5个月前顶配模型,现在价格只要1/3,速度还翻倍

0
分享至


新智元报道

编辑:KingHZ 好困

【新智元导读】Anthropic用Haiku 4.5打响了AI性价比之战!曾经的顶配性能,如今以三分之一的价格、两倍的速度下放,可以说是对高价AI模型的一次降维打击。

AI竞赛风云再起!

刚刚,Anthropic突然出手——发布了全新升级的小模型Claude Haiku 4.5

它以更强的智能、更快的速度、三分之一的成本,直接打起了AI价格战!

在核心编码测试中,Haiku 4.5已能与GPT-5和Sonnet 4平起平坐,部分任务甚至实现反超。


· Haiku 4.5:输入1美元/百万token,输出5美元/百万token;

· Sonnet 4:输入3美元/百万token,输出15美元/百万token;

· GPT-5/Codex:输入1.25美元/百万token,输出10美元/百万token。

在SWE-bench Verified测试中,Haiku 4.5虽以1.2%的差距落后GPT-5,但输出价格只有后者的1/2,输入为4/5。

当AI性能趋于饱和、成本断崖下跌,「谁能用最低代价释放最大智能」,正成为2025年AI产业的新分水岭。

Haiku 4.5不是Claude系列最强的模型,但它代表了AI经济学的新方向——

高智能不再昂贵,速度与效率才是下一个王座

Haiku 4.5更强更便宜

5个月前,Claude Sonnet 4还是顶尖技术的代表。如今,Haiku 4.5以三分之一的成本和两倍以上的速度,实现了与其同等的编程性能。

Haiku 4.5在计算机操作任务上已超越Sonnet 4,让Chrome版Claude的运行速度更快。

在Claude Code中,它使多智能体项目和快速原型开发的响应速度显著提升。

2025年是智能体元年,Haiku 4.5是Anthropic的最新一招。

在多项智能体相关测试中,Haiku 4.5比Sonnet 4更强。

具体来说,在软件工程基准测试SWE-bench Verified中,Haiku 4.5获得73.3%的分数——

略高于Sonnet 4的72.7%,GPT-5(high)的72.8%并接近GPT-5 Codex的74.5%。

在Terminal-Bench编码基准测试中,Haiku 4.5得分为41.0%,在Claude系列模型中仅次于Sonnet 4.5的 50.0%。

换句话说,基于Haiku 4.5的AI智能体比基于Sonnet 4的AI智能体,更容易使用命令行工具完成复杂软件任务。

在计算机操作任务基准测试OSWorld中, Haiku 4.5取得了50.7%的成绩,而Sonnet 4为42.2%。

这种能力使AI能够直接与计算机界面交互——点击按钮、填写表单、浏览应用——这有望彻底改变常规数字化任务的自动化方式。


但在推理能力上,Haiku 4.5在多项测试中稍逊Sonnet 4一筹,如研究生级别推理基准测试GPQA Diamond、多语言问答MMMLU、视觉推理测试MMMU等测试上。

唯一的惊喜是,在高中数学竞赛AIME 2025上,Haiku 4.5即便不使用工具,准确率仍比Sonnet 4高10%以上!

在Claude文档中,Anthropic称Haiku 4.5和Sonnet 4.5各有所长,针对的是不同的用户场景:

Claude Sonnet 4.5:针对复杂智能体与编程任务的最优模型,在多数任务中具备最高智能水平

Claude Haiku 4.5:速度最快、智能最高的Haiku模型,性能接近顶级水平。首款支持扩展思考能力的Haiku模型


也就是说,Claude Sonnet 4.5依然是Anthropic的旗舰型号,也是目前全球最强的编码模型。

相比之下,Haiku 4.5为用户提供了新选择:当需要接近顶级的性能,但对成本和效率有更高要求时,Haiku 4.5便是最佳答案。

Claude Haiku 4.5还是Anthropic旗下首款支持扩展思考模式的Haiku模型,便宜模型也有高级推理能力:

  • 高速推理:可访问Claude内部推理过程,助力复杂问题解决

  • 思考总结:提供适用于生产环境的思考输出摘要

  • 交错思考:在工具调用间进行思考,支持更复杂的多步骤工作流

  • 预算控制:通过配置思考令牌预算,平衡推理深度与响应速度

Claude Haiku 4.5具备原生上下文感知能力、现代Claude模型应有的强大编程能力。

Haiku 4.5为标准用户提供20万token的上下文窗口,而访问Claude开发者平台的开发者则可使用100万token 的上下文窗口。

这一扩展容量意味着:在单次请求中,模型可处理极其庞大的代码库或文档——大约相当于一本1500页的书。

这种「高智能+高速度」的结合,或将彻底颠覆那些需要实时、低延迟响应的应用场景——如聊天助手、在线客服、结对编程等。

对于开发者而言,无论是构建复杂的多智能体项目,还是进行快速的产品原型设计,Haiku 4.5都意味着更快的速度,让开发体验变得前所未有的流畅。

更重要的是,这开启了大小模型协同工作的新范式。

例如,开发者可以先用旗舰级的Sonnet 4.5将一个复杂问题拆解为多步计划,然后调度一个由多个Haiku 4.5组成的「工作小队」,并行完成各个子任务。


这种「一个大脑,多双快手」的模式,将极大提升AI系统解决复杂问题的效率和能力。

业内许多人称,AI正进入的关键转折点。




左右滑动查看

进步的代价

对于正在评估AI战略的企业而言,Haiku 4.5既是机遇,也是挑战。

机遇在于:大幅降低的成本,让过去部分无法承受的规模化部署成为可能。

问题在于,AI技术格局的演进速度,已经超出了大多数组织的吸收能力。

正如Anthropic首席产品官Mike Krieger近期在播客中所言,企业正摆脱「AI错失恐惧症」,转而要求具体的指标和可证明的价值。


但建立这些指标和评估框架需要时间——而随着竞争对手的飞速发展,时间可能所剩无几。

从单模型部署到多智能体架构的转变,也要求以新的方式思考AI系统。

企业必须学会编排多个专业化的智能体,每个都为特定任务进行优化,而不再将AI视为一个单一的助手——

这更像是管理一个团队,而非操作一个工具。

AI的基本经济学正在以惊人的速度转变——

今日看来非凡的AI能力,在一年内可能就会变得司空见惯且价格低廉。


Epoch AI:大语言模型的推理价格,正断崖式下跌,但并非均匀分布在所有领域

Anthropic坚持以安全为先的差异化路线,但如何将技术成就转化为可持续的业务增长?

企业是否会选择Claude,而非OpenAI、谷歌以及越来越多竞争对手所提供的日益强大的替代品,这仍是一个悬而未决的问题。

但Anthropic正下一个明确的赌注:未来,单一的最强大模型难题称霸AI行业,而合适的速度、合适的价格、合适的智能才是未来存活的关键。

AI行业的承诺往往超越现实,但Anthropic正以超预期速度兑现:低成本、高性能即是胜利的关键。五个月内价格降至三分之一、性能稳定,这一愿景已成现实。

随着价格在短短五个月内下降三分之二而性能保持稳定,这一承诺正开始变为现实。

参考资料:

https://venturebeat.com/ai/anthropic-is-giving-away-its-powerful-claude-haiku-4-5-ai-for-free-to-take

https://www.anthropic.com/news/claude-haiku-4-5

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
老板娘的丝袜都破了,我要不要告诉她买一双?

老板娘的丝袜都破了,我要不要告诉她买一双?

太急张三疯
2026-03-26 12:50:15
刘亦菲安妮海瑟薇站边角,金智媛抢C位,宝格丽合照藏了什么规则

刘亦菲安妮海瑟薇站边角,金智媛抢C位,宝格丽合照藏了什么规则

手工制作阿歼
2026-03-26 10:34:27
马英九亲自下场后,蓝营大佬集体回应,台媒体人:罪在马英九

马英九亲自下场后,蓝营大佬集体回应,台媒体人:罪在马英九

DS北风
2026-03-25 18:50:17
陈云晚年首次披露:遵义会议上这两个人死活不同意毛主席,吵得面红耳赤

陈云晚年首次披露:遵义会议上这两个人死活不同意毛主席,吵得面红耳赤

老杉说历史
2026-03-21 17:38:44
A股三大指数均跌逾1%,全市场下跌个股超4500只

A股三大指数均跌逾1%,全市场下跌个股超4500只

界面新闻
2026-03-26 13:24:15
南京男子回家迫不及待抱住妻子,结果家中鹦鹉一开口,让他崩溃!

南京男子回家迫不及待抱住妻子,结果家中鹦鹉一开口,让他崩溃!

白云故事
2025-03-14 19:05:07
既然只是“劝架”,为什么要砸碎人家的镜子?

既然只是“劝架”,为什么要砸碎人家的镜子?

胖胖说他不胖
2026-03-26 14:05:04
周杰伦新专辑引吐槽声一片,还牵扯两段绯闻,歌不行只剩炒作?

周杰伦新专辑引吐槽声一片,还牵扯两段绯闻,歌不行只剩炒作?

乐天闲聊
2026-03-26 10:48:17
伊朗军方公布第26天作战行动细节 打击多处美以目标

伊朗军方公布第26天作战行动细节 打击多处美以目标

极目新闻
2026-03-26 14:33:54
美国114页报告得出结论:若跟中国开战,战争将在1个月内结束

美国114页报告得出结论:若跟中国开战,战争将在1个月内结束

林子说事
2026-03-26 14:08:00
厉害,郑州大学第一附属医院一次派70名人员进驻这家三甲医院

厉害,郑州大学第一附属医院一次派70名人员进驻这家三甲医院

周哥一影视
2026-03-26 13:34:56
剖腹自尽?日本陆自军官持刀冲入中国大使馆,想杀中国外交员!

剖腹自尽?日本陆自军官持刀冲入中国大使馆,想杀中国外交员!

军武次位面
2026-03-26 14:26:42
巴斯夫(广东)一体化基地全面投产,黄坤明等中外嘉宾共同启动

巴斯夫(广东)一体化基地全面投产,黄坤明等中外嘉宾共同启动

广东发布
2026-03-26 10:57:43
溥仪晚年见老宫女乞讨,问她为何不嫁人?宫女:我们这些人怎么嫁

溥仪晚年见老宫女乞讨,问她为何不嫁人?宫女:我们这些人怎么嫁

千秋文化
2026-01-29 21:22:16
河南郑州,10岁男孩在上课时与同桌发生矛盾。老师竟然让两...

河南郑州,10岁男孩在上课时与同桌发生矛盾。老师竟然让两...

网络易不易
2026-03-26 14:05:04
电饭锅哪个牌子质量好?2026电饭煲排名前十盘点!大众主流精选

电饭锅哪个牌子质量好?2026电饭煲排名前十盘点!大众主流精选

小柱解说游戏
2026-03-25 17:56:15
张雪峰被曝心脏骤停抢救,前一天还在大鱼大肉,一人吃6个菜

张雪峰被曝心脏骤停抢救,前一天还在大鱼大肉,一人吃6个菜

映射生活的身影
2026-03-24 18:27:44
日军官闯中国使馆后,天皇玄孙迅速澄清,高市失声,特朗普没说错

日军官闯中国使馆后,天皇玄孙迅速澄清,高市失声,特朗普没说错

谛听骨语本尊
2026-03-25 16:26:02
对越反击战期间,越南女兵的诡计有多离谱?敢将自己脱得赤条条的

对越反击战期间,越南女兵的诡计有多离谱?敢将自己脱得赤条条的

抽象派大师
2026-03-26 10:58:00
新消息!伊朗突然宣布了!

新消息!伊朗突然宣布了!

达文西看世界
2026-03-23 20:29:16
2026-03-26 17:52:49
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
14819文章数 66721关注度
往期回顾 全部

科技要闻

Meta高管狂分百亿期权,700名员工却下岗

头条要闻

男子从四家公司贷出共计356万元 实际到手却仅8万多元

头条要闻

男子从四家公司贷出共计356万元 实际到手却仅8万多元

体育要闻

申京努力了,然而杜兰特啊

娱乐要闻

张雪峰家人首发声 不设追思会丧事从简

财经要闻

长护险谁能享受?享受多少?解答来了

汽车要闻

一汽奥迪A6L e-tron开启预售 CLTC最大续航815km

态度原创

本地
旅游
房产
手机
军事航空

本地新闻

救命,这只酱板鸭已经在我手机复仇了一万遍

旅游要闻

视点|陶然亭公园海棠春花文化节,解锁春日新体验

房产要闻

突发,三亚又有大批征迁补偿方案出炉!

手机要闻

顶配Ultra旗舰!vivo X300 Ultra配置公布:骁龙8E5+2K/144Hz直屏、8.19mm机身

军事要闻

担心特朗普突然停战 以总理下令48小时尽力摧毁伊设施

无障碍浏览 进入关怀版