网易首页 > 网易号 > 正文 申请入驻

Haiku 5.5发布,Anthropic开始撒钱

0
分享至

前几天Claude刚增加了简体中文界面,这会儿国庆假期刚过,Anthropic又把Haiku 5.5拿出来了。

这是Haiku系列今年第一次更新,也是继9月22日Opus 5.5、9月28日Sonnet 5.5后,Anthropic在大约半个月里补齐的第三款5.5模型。



这次更新,Haiku 5.5把短上下文调用的价格一口气砍了90%。

在10万Token以内,每百万Token输入只要0.1美元,输出0.5美元,缓存读取甚至只要0.01美元。上一代Haiku 4.5对应的价格还是1美元、5美元和0.1美元。

Anthropic自己算下来,大多数典型工作负载的实际成本大约降了75%。



可以说,在OpenAI把Luna卖到一毛钱之后,Anthropic只用了15天,就把Haiku的输入从1美元压到了一毛钱,直接贴着GPT-6 Luna打。

而且Anthropic今天砍价的还不止Haiku。

几乎同时,它又宣布把Sonnet 5.5的缓存读取价格直接减半,从每百万Token 0.2美元降到0.1美元。

这个数字,同样正好追平GPT-6.1 Sol。



这还没完。从本周开始,Claude Max和Team用户每个月都会得到一笔Claude Platform额度:Max 5x是100美元,Max 20x是200美元,Team则根据席位计算,最多可以共享500美元。

换句话说,至少按照API额度的面值来看,Anthropic几乎把Max用户每个月交给它的订阅费,又原样返了一份回来。



上市在即,Anthropic现在简直是演都不演了。

01

跑腿担当Haiku 5.5

上一代Haiku 4.5推出还是去年10月,这次的Haiku 5.5可是时隔一年的“大更新”,非常有看头。

首先是基础规格。Haiku 4.5只有20万Token上下文,到Haiku 5.5直接拉到了100万Token;最大输出也从6.4万Token翻倍到12.8万Token。



它还第一次加入了Adaptive Thinking和可调节的effort——简单来说,以前Haiku更像一台只管快速给答案的小模型,而现在,遇到稍微复杂一点的问题,也可以自己决定要不要动动脑子。

同时新增的还有Browser Use,让模型直接操作网页;安全机制也换上了新的分类器拒答机制。



便宜快速依然是Haiku最重要的卖点。

按照Anthropic的说法,Haiku 5.5是目前Claude家族里标准模式下速度最快的模型,适合那些需要低延迟、大量调用的任务。比如实时聊天、客服、语音助手、信息提取、文件整理,以及越来越常见的浏览器和电脑操作。

官方列出的典型场景里,最值得关注的就是把它作为Opus和Sonnet下面的Subagent——之前只是简单一提,到5.5这一代,Subagent已经被Anthropic明确放进了Haiku的核心用途里。

可以认为,Haiku正在变成Claude家族里专门负责“跑腿”的那个。

比如你让AI做一份报表,负责整体结构和判断的可能还是Opus或者Sonnet,但查一份财报里的具体数字、整理一批资料、点几下网页、分类一堆信息,这些小任务完全可以交给Haiku。



这个定位和OpenAI刚发布的GPT-6 Luna非常像,同样主打高频、大规模、成本敏感的任务,上下文也同样是约100万Token,最大输出12.8万Token。

关键是,这两款模型的价格也被拉到了几乎相同的位置。

Haiku 5.5在10万Token以内,每百万Token输入0.1美元、输出0.5美元、缓存读取0.01美元;Luna也是0.1美元、0.5美元和0.01美元。

不过,Haiku 5.5一旦Prompt超过10万Token,整档价格会直接涨到短上下文的5倍:输入变成0.5美元、输出2.5美元、缓存读取0.05美元。

Luna那边也不是一成不变,但变得比Haiku温和一点。OpenAI规定,Prompt超过27.2万输入Token后,整次请求都会按长上下文价格计费:输入和缓存价格翻倍,输出涨到1.5倍,也就是0.2美元输入、0.75美元输出、0.02美元缓存读取。

说完了价格,该看看性能了。



至少从Anthropic公布的测试来看,Haiku 5.5在不少Agent相关任务上压了Luna一头,甚至超了不少。

比如在电脑操作测试OSWorld 2.1上,Haiku 5.5拿到72.4%,GPT-6 Luna只有48.9%;Agent Coding测试Terminal-Bench 4.0里,Haiku是39.2%,Luna只有16.4%;FrontierCode 1.1上,两者分别是46.4%和42.4%。

知识工作也类似。在GDPval-AA v2.1里,Haiku 5.5拿到1620分,Luna是1437分;AA-Briefcase v1.1则是1578分对1336分。

另外,在第三方评测平台Artificial Analysis的Intelligence Index上,Haiku 5.5最高档拿到43分,而GPT-6 Luna最高档是38分。



不过Luna也不是全面落后。在Artificial Analysis自己的电脑/网页自动化评测AutomationBench-AA上,Luna反而以53.2%明显超过Haiku的35.4%。

现在Haiku 5.5已经进入Claude的Free、Pro、Max、Team和Enterprise套餐,Web、iOS和Android都能用;开发者也可以通过Claude API、Claude Code,以及AWS、Google Cloud和Microsoft Foundry调用。

顺便一提,虽然Anthropic在发布公告里直接把Haiku 5.5称为目前最快的Claude模型,但在脚注里又很老实地补了一句:这是指各模型都跑在标准速度下的情况。如果打开快速模式,Haiku 5.5还是跑不过Opus。



拿最便宜的“跑腿模型”和最贵的加速档比,多少有点不讲武德。

02

统统大降价

然而,和另外两个“撒币”行为相比,Haiku 5.5简直就像开胃小菜。

Anthropic同时正式下调了Sonnet 5.5的缓存读取价格,从每百万Token 0.2美元降到0.1美元,目前没有注明任何限时条件。Haiku 5.5公告里的最新价目表已经把Sonnet 5.5的价格改了。

这看起来只是价目表里一个不起眼的小数字,但对Agent来说,影响可能比想象中大得多。

Anthropic自己估算,因为Agent在长时间运行时会反复读取系统提示词、工具定义和历史上下文,缓存读取往往会消耗很大一部分Token,所以这一刀下去,大多数Agent任务跑Sonnet 5.5的总体成本还能再降大约20%。

在这条降价消息下面,开发者几乎是一片叫好。









可以说,Anthropic直接从两头一起给Agent压价:一边把跑腿的成本压下去,另一边把主Agent长期工作的成本也压下去了。

更离谱的还在后面:

从这周开始,Claude Max和Team套餐会额外附赠一笔Claude Platform API额度:Max 5x每月100美元,Max 20x每月200美元;Team则按照席位计算,所有额度汇总到一起,每月最多500美元。



也就是说,从API标价来看,一个Max 20x用户每个月交200美元订阅费,Anthropic现在又额外给他发200美元API额度。

而且这笔钱和原本Claude、Claude Code、Cowork里的订阅用量是分开的,不会占掉原来的额度。虽然没用完会过期,但每个计费周期都会重新发。

更重要的是,官方表示这些额度可以用于Claude API、Batch API、Claude Console Playground、Claude Managed Agents和Claude Agent SDK,而且任何当前可用的Claude模型都能花。

这意味着,只要第三方Harness最终调用的是你这个Claude Console组织里的API Key,同样可以消耗这笔余额。

你可以自己写一个Agent,可以用Agent SDK,可以让别人的Harness调用Claude。只要最后用的是Anthropic的Token,它甚至愿意先替你出一部分钱。

(账号仍然完好的)Max用户简直要笑疯了好吗?





不过,这也不是完全没有限制。

API额度不能拿来抵Claude Code里的交互式使用,也不能抵Claude、Claude Code和Cowork超额之后的Extra Usage;Bedrock、Google Cloud Vertex AI和Microsoft Foundry里的Claude调用也不算,新Max或Team用户还要先订阅满7天才能领取。

但这些限制并不影响它的方向,Anthropic几乎要把“快来订阅”顶在脑门上。

说来有趣,就在前几天,Claude社区里还有人在认真讨论:Anthropic需要一款更便宜的模型。



有人专门拿Haiku 4.5和刚发布的GPT-6 Luna算了一遍账。前者每百万Token输入1美元、输出5美元,后者只有0.1美元和0.5美元,整整差了十倍。在Agent会大量调用worker模型的情况下,这个差距足以直接决定开发者的选择。

有人甚至直接说,虽然他们公司喜欢Claude,但真正干活的主力模型还是Luna,原因就是API账单差太多。

结果,社区前脚还在说Claude太贵,Anthropic后脚就像把评论区打印出来了一样,直接开始大降价。

把今天这三件事放在一起看,Haiku负责让Subagent便宜,Sonnet负责让长时间运行的Agent便宜,API Credit则直接给Max和Team订阅再塞一笔开发预算。

为了推动Claude进入更多Agent和Harness、再冲一下销量,Anthropic也开始搞“百亿补贴”了。

03

上市前,再冲一把

这一连串的动作,很难不和Anthropic即将上市的消息联系在一起。简直就像商场开业前先发点优惠券来吸吸流量——如果它还需要更多流量的话。

路透社在Haiku 5.5发布之后直接把这次更新放在了IPO语境里:Anthropic正在为计划中的上市继续扩充Claude产品线。Haiku 5.5也是Claude 5.5家族在一个月内补齐的第三款模型。

此前报道显示,Anthropic原本最早计划在10月中旬启动IPO营销,但最新安排可能推迟到11月美国中期选举之后。如果计划不再继续后移,Anthropic最快也就是接下来这一两个月正式冲刺上市。



而且Anthropic现在其实很需要在上市前继续证明自己的增长。

路透社此前披露,Anthropic的年化收入已经从2025年底大约90亿美元,一路冲到今年7月底超过650亿美元;公司内部还预计,2028年收入可能达到1900亿至2000亿美元。

这意味着,它现在最需要证明的,不只是Claude够不够强,还有Claude能不能继续卖得更多。

尤其是,OpenAI还在持续施压。

路透社此前援引Ramp数据称,GPT-6 Astra已经拿到其追踪企业AI支出的约13%,Claude Fable约为8%;OpenRouter上,OpenAI模型的用户支出也一度超过Anthropic,这是两年半以来第一次。消息人士称,这已经让一些潜在IPO投资者重新评估Anthropic此前在企业AI市场的领先位置。

现在看来,这篇报道标题中提到的“新模型”,应该指的就是5.5这一套组合。



某种意义上,Anthropic这次几刀,几乎都是冲OpenAI去的——OpenAI把价格往下打到哪里,Anthropic就跟到哪里。

Haiku 5.5把短上下文输入价格从1美元直接压到0.1美元,正好和GPT-6 Luna同价;Sonnet 5.5的缓存读取从0.2美元砍到0.1美元,又正好追平GPT-6.1 Sol。

说到底,上市前最怕的就是增长不好看。

如果模型价格更低,可以换来更多API调用;如果Max订阅更划算,可以换来更多付费用户;如果开发者更愿意把Claude塞进自己的Agent和Harness里,也就意味着未来可能有更多稳定的Token消费。

今天这些降价和补贴花出去的钱,可以先算成获客成本。只要它能在上市前把用户、收入和调用量再往上冲一冲,这笔账就不难解释。(作者:袁心玥)

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
尊界V800现刹车踏板断裂事件,鸿蒙智行销售称被消费者追问了一天

尊界V800现刹车踏板断裂事件,鸿蒙智行销售称被消费者追问了一天

新京报
2026-10-08 18:28:14
沈阳新娘远嫁杭州,娘家30口人自驾送亲,新郎只愿付当天住宿费

沈阳新娘远嫁杭州,娘家30口人自驾送亲,新郎只愿付当天住宿费

兰姐说故事
2025-08-21 20:05:04
曾夺走 2 亿人生命的鼠疫再敲警钟,俄罗斯实验室鼠疫事件的 4 重警示

曾夺走 2 亿人生命的鼠疫再敲警钟,俄罗斯实验室鼠疫事件的 4 重警示

怪味历史连连看
2026-10-07 15:47:32
WTT中国大满贯:国乒4人晋级女单8强!陈幸同3-0横扫大藤沙月

WTT中国大满贯:国乒4人晋级女单8强!陈幸同3-0横扫大藤沙月

全言作品
2026-10-08 20:55:18
为谢贤秘密生子真相大白!Coco近况曝光,难怪自曝猛料按耐不住

为谢贤秘密生子真相大白!Coco近况曝光,难怪自曝猛料按耐不住

娱说瑜悦
2026-10-06 15:48:41
远东集团赚大陆钱捐“台独”?被大陆精准的反制后,发展咋样?

远东集团赚大陆钱捐“台独”?被大陆精准的反制后,发展咋样?

暮雪无痕
2026-09-20 18:41:20
蔡天凤被害3年后,再看丈夫谭方骏和蔡母现状,方媛的话有人信了

蔡天凤被害3年后,再看丈夫谭方骏和蔡母现状,方媛的话有人信了

傲傲讲历史
2026-10-08 09:48:40
64岁董文华,瘫痪母亲、下岗亲人,丈夫的选择让人泪目

64岁董文华,瘫痪母亲、下岗亲人,丈夫的选择让人泪目

阿嬍体育评论
2026-10-08 11:27:18
苹果手机自带收音机功能!不用流量不用联网,9成用户一直没用对

苹果手机自带收音机功能!不用流量不用联网,9成用户一直没用对

小蜜情感说
2026-10-08 01:23:14
正当年的人,别倒在领退休金前;部分70后80后可能熬不到领退休

正当年的人,别倒在领退休金前;部分70后80后可能熬不到领退休

白米饭怎么吃
2026-10-06 21:21:08
10月7日,真相逐渐浮出水面:就是055驱逐舰拉爆了美军驱逐舰!

10月7日,真相逐渐浮出水面:就是055驱逐舰拉爆了美军驱逐舰!

果妈聊娱乐
2026-10-07 16:12:28
为亲人喊冤14年的河南农妇,终于把自己也喊进了监狱

为亲人喊冤14年的河南农妇,终于把自己也喊进了监狱

塔子山评说
2026-06-29 16:49:51
实体店末日?人民日报怒批,死的不是实体店,是 20 年不变经营脑!

实体店末日?人民日报怒批,死的不是实体店,是 20 年不变经营脑!

抽象派大师
2026-08-29 18:48:17
嫌网红太贵,连锁面包店让财务总监自己上,结果近千万人围观!网友:不愧是管钱的!

嫌网红太贵,连锁面包店让财务总监自己上,结果近千万人围观!网友:不愧是管钱的!

新欧洲
2026-10-08 20:09:40
2026年诺贝尔文学奖揭晓

2026年诺贝尔文学奖揭晓

农视网
2026-10-08 21:39:06
尊界的刹车踏板断了,但大老板的咖啡不能洒

尊界的刹车踏板断了,但大老板的咖啡不能洒

吃瓜体
2026-10-08 11:36:45
AI编程没那么好玩了

AI编程没那么好玩了

我是一个养虾人
2026-10-07 00:30:56
莫言:永远不要期望一个没有血缘关系的人,能站在你的角度替你考虑|成年人最大的清醒

莫言:永远不要期望一个没有血缘关系的人,能站在你的角度替你考虑|成年人最大的清醒

杏花烟雨江南的碧园
2026-07-27 11:15:03
鲁比奥雅典卫城惊人演讲:西方文明生死存亡,欧洲必须醒醒!

鲁比奥雅典卫城惊人演讲:西方文明生死存亡,欧洲必须醒醒!

旧窗老街
2026-10-08 19:53:13
中国为什么不信巴基斯坦和俄罗斯?说穿了,中国早清楚一个真理:瓜达尔港、中俄天然气背后都有算盘,看懂才知主动权在谁手里

中国为什么不信巴基斯坦和俄罗斯?说穿了,中国早清楚一个真理:瓜达尔港、中俄天然气背后都有算盘,看懂才知主动权在谁手里

谈史论今1
2026-10-05 20:16:51
2026-10-09 04:03:00
字母榜 incentive-icons
字母榜
让未来不止于大。
2824文章数 8094关注度
往期回顾 全部

科技要闻

江淮汽车回应"尊界V800刹车踏板支架断裂"

头条要闻

女局长被举报婚内出轨至少9人 大量亲密聊天记录公布

头条要闻

女局长被举报婚内出轨至少9人 大量亲密聊天记录公布

体育要闻

30天30队·鹈鹕:胖虎又一年“如果”

娱乐要闻

演员王晓慧刚担女主,就被曝已婚生子

财经要闻

央行:中国从不搞竞争性货币贬值

汽车要闻

特别版配色/碳纤尾翼 2027款深蓝L06将于10月9日上市

态度原创

教育
旅游
时尚
本地
手机

教育要闻

回顾:“吊瓶班”学生无一人考上一本!网友:表演式努力骗人骗己

旅游要闻

接待游客249.48万人次,国庆假期潍坊文旅营收超1.8亿

西装+裙子,穿出大女人的浪漫与时髦

本地新闻

转型再出发 奋勇打头阵

手机要闻

内存涨价压垮利润!三星手机计划Q4减产高达30%

无障碍浏览 进入关怀版