“同样的项目,同样的工作强度,但现在我能做的只有过去的四分之一。”一位Claude Code Max 5x计划的用户在Reddit上详细记录了他的发现:在过去,他可以同时跑3到4个会话,撑满3到4个小时;现在,一个会话不到一小时就能吃掉整个5小时窗口的限额。
这不是个案。社区中多位Max计划订阅者反映,最近几周的限额耗尽速度肉眼可见地加快了。有用户甚至开玩笑说,现在打开Claude Code,喝杯咖啡的功夫,系统就提醒你该等下一轮了。
![]()
最让用户感到不解的,是一些轻量任务的消耗表现。过去,更新几份文档、编辑几条本地化字符串、调整几个UI组件——这些操作能在4小时窗口里自由组合,完成一整轮的日常维护。如今,这些任务“几乎立即触达限额”。另一位用户测试了一个更简单的动作:在会话中发送一条“continue”消息,什么都不做,仅这条消息就消耗了约3%的五小时总限额。按这个速度计算,33次“continue”就能清空整个窗口。
还有一个1.5百万token的仓库审计任务,直接吃掉了窗口的30%。这个数字本身可能不算离谱——大量上下文确实消耗tokens——但结合轻量任务的表现,用户们嗅到了不对劲的气息。Reddit上这位发帖者特别强调了一点:“现在的工作负载比几个月前要轻得多。”他的项目没变,文件结构没变,但他能用Claude Code完成的事,缩水了。
与此同时,一个与限额无关但增加了焦虑感的Bug也浮出水面。该用户在处理一款普通的美甲预约应用时,多次碰到服务端的内容策略限制提示——没有敏感内容,没有版权材料,纯粹是美容行业的常规业务逻辑。这也让部分用户开始怀疑:后台是否在进行某些未通告的调整。
三个最可能的解释
社区讨论里,几种猜测反复出现,目前没有人能给出确切结论,但每一条都指向同一个方向——你的每分钱,能买到的东西正在变少。
一、用量核算方式变了。 Anthropic可能调整了“活跃时间”的计算逻辑。过去可能只计模型推理耗时,现在也许把上下文加载的时间也算进去了。对于需要加载大量项目文件的开发者来说,这个改动会让每一轮交互的“起步价”大幅上升。Reddit上有人打了个比方:以前打车只算行驶里程,现在从你拉开门的瞬间就开始跳表。
二、后端模型成本涨了,但套餐没跟着涨。 Claude Code在后台实际调用的是什么模型?社区普遍推测是Claude Opus 4.6或更新的版本。这些模型的能力更强,但推理成本也可能更高。如果Anthropic提升了默认模型等级,却没有等比提升Max计划的token预算,结果就是用户花同样的200美元月费,能完成的实际工作量倒退。这不是价格上涨,这是通货膨胀——单位货币的购买力被悄悄稀释了。
三、这就是一个Bug。 那条“continue”消息吃掉3%限额的表现,怎么看都像个计算错误。如果Anthropic的计量系统在某个环节出现了重复计费或上下文膨胀计数的Bug,那么受影响的范围可能不止这位Reddit用户,而是所有Max计划订阅者。目前,Anthropic尚未公开回应。
在官方修复前,可以做的四件事
不确定性是焦虑的最大来源,但等待不等于束手无策。社区里已经有资深用户整理出一套“限额节流”方案,核心思路是:减少每一轮上下文加载的垃圾数据量。
1. 查清楚Claude Code到底加载了什么。 很多开发者对自己项目在Claude Code眼中的“体重”一无所知。运行下面这条命令,可以看到Claude Code实际塞进上下文的完整内容:
claude code --dry-run --verbose输出会告诉你三件事:哪些大文件被不必要地加载了,哪些整个目录被读取但你其实只需要其中一两个文件,以及对话历史是不是已经膨胀到了惊人的长度。用户报告里提到,有些项目的上下文里塞满了自动生成的`node_modules`路径信息、编译产物和日志文件,删掉这些引用后,token消耗直接砍掉20%以上。
2. 把 `/compact` 用起来。 Claude Code自带一个叫 `/compact` 的标识,它的作用是压缩对话历史——把冗长的交互记录提炼成摘要形式,而不是逐字发送。社区反馈显示,在长时间运行的会话里,这个操作能减少40%以上的token消耗。如果你习惯一口气跑整个下午的开发任务,把它加进启动命令(`claude code /compact`)会是个好习惯。
3. 收紧 CLAUDE.md 规则。 CLAUDE.md 不只是放项目背景的地方,它也能充当Claude Code的“操作手册”。更明确的规则可以减少AI自作主张加载多余文件的行为。下面这组规则被社区验证过,能有效降低单次交互的token开销:
## Token Budget Rules- 当被要求审计或分析时,先询问用户具体需要哪些文件。- 除非用户明确要求,否则单次不要加载超过3个文件。- 优先用摘要形式汇报发现,而不是完整复制文件内容。这种约束的本质,是把“一次性加载所有可能相关的东西”这个默认行为,改成“先问再拿”,对轻量任务的影响尤其明显。
4. 砍掉越来越长的会话,重新开始。 对话历史会随时间线性增长,而Claude Code处理历史的方式是每次请求都带上完整历史。这意味着,一个运行了两小时的会话,后半程的每一次交互都在为前面的历史付费。当任务自然分段时(比如功能开发完成、切换到Bug修复),结束当前会话开一个新的,能让每一轮都轻装上阵。
这件事到底意味着什么
站在用户的角度,这件事让人不舒服的点不在于涨价本身——产品调整价格是企业的自由。让人不舒服的是透明度的缺失。如果Anthropic调整了用量计算方式,或者升级了后台模型导致实际可用量缩水,正常的做法是发邮件通知、更新文档、在定价页标清楚。而不是让用户在Reddit上自己对比截图算比例,然后得出“我200刀的套餐现在只能当50刀用了”的结论。
从产品逻辑来看,限额机制的设计本意是管理后端负载,这可以理解。但当用户的体验从“我有充足时间完成规划好的任务”滑向“我得想尽办法省着用”时,这个工具的定位就变了。Claude Code从生产力工具,变成了一个需要精打细算的资源管理系统。对于以效率为核心的开发者群体来说,这比性能下降更难接受。
目前,Anthropic尚未就此事发布任何说明。社区呼声集中在两个方向:一是要求官方澄清是否是Bug(如果那个3%“continue”确实是个错误,修复它对所有人都有好处);二是希望Max计划的计费方式能更透明,哪怕不降价,至少让人知道每分钱花在了哪里。
在答案到来前,上述四条节流方案是能立刻落地的动作。它们不改变底层规则,但能让你的餐盘里多留几口饭吃——在当前的不确定窗口期,这可能是唯一确定的东西。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.