如果你的AI终于学会“干活”了,账单也水涨船高——这大概是8月13日DeepSeek开源Harness后,不少开发者的直观感受。Harness是DeepSeek定义的智能体执行框架,官方公式“Model+Harness=Agent”,帮模型完成工具调用、任务规划、执行调度这些“动手”的活。
![]()
DeepSeek Harness开发者预览版官方页面展示
就在同一天,DeepSeek宣布API采用峰谷定价,高峰时段价格直接翻倍。一边是“真能干事了”,一边是Token消耗也随之明显放大。这笔账,到底要谁来扛?
先看受伤的一方,开发者的账单涨了多少倍
对中小开发者和个人来说,这是最直接的一击。官方9月底推出的6元体验赠金可以侧面透露出扣费之快:按典型Agent任务比例估算,6元约能覆盖1.2亿缓存命中输入、148万缓存未命中输入和52万输出Token——在Harness里,这点钱撑不了几天重活。
![]()
更难受的是时段问题——工作日9点到12点、14点到18点调用,价格按两倍计,AI最忙的时段偏偏撞上最贵的档位。
![]()
DeepSeek-V4 API峰谷时段定价标准公示
对企业级生产用户,问题从“贵”升级成“项目还做不做”。一个现实注脚是,9月下旬智谱AI编程工具ZCode陷入“偷传代码”风波,有企业客户开始禁用,把它移出生产环境。
再看受益的一方,平台和插件赚到了什么
同样一份高Token账单,在另一边却是实打实的收入。
对DeepSeek而言,Harness用户的Token消耗量是普通API用户的数倍,叠加峰谷定价,这本身就是一条收入增量。DeepSeek API业务毛利率达到82.9%,2026年前7个月收入约4.75亿元。
第三方插件开发者挤进了收益名单。官方口径下,约60%的Harness用户在使用第三方插件,得益于“一切皆插件”的架构,开发者不用自己搭Agent执行链路,开发成本大幅降低。一个小工具吃整个生态的增长红利,这是传统开源Agent时代拿不到的机会。
![]()
于是局面被撕成两半:一边是科研用户直言“对价格敏感,涨价之后真是用不起”,另一边是平台和插件生态吃到了放大的流水。
成本没消失,只是被产业链一起吞了
但这笔钱总要有人扛——它正在变成一场全行业的降本竞赛。9月22日,基元律动在云栖大会发布开源项目OpenSquilla,用智能多模型路由把成本降低88.9%,同时保留旗舰模型99.96%的任务质量。9月里:
![]()
云栖大会现场嘉宾介绍OpenSquilla项目
- 华为云发布智果AgentArts,主打长程任务
- 阿里云抛出“Model、Harness、Context”三层架构和Context Engine,专攻冗余上下文加载
- 蚂蚁密算开源HOP架构,遏制Agent“死亡螺旋”烧Token
- 云知声开源决策大模型U2-Decision,在调度层过滤无效调用
云厂商、大模型厂商、开发者社区几乎同时把枪口对准了Token浪费。
![]()
OpenSquilla产品版本演进路线展示
我的判断是:这笔账单的抬升,一半是Agent多轮交互、长任务闭环的技术结构决定的——Harness要让AI“真干活”,就得多问、多想、多跑几步;另一半是DeepSeek的商业化选择——峰谷涨价配合Token放大,把单用户价值做上去,为商业化能力铺路。
短期内,开发者靠路由、裁剪、缓存这些工具把账单一压再压,但Token计费“对过程负责、不对结果负责”的底层逻辑没变,业内已经在讨论“按任务计费”这类新模式。在产业成熟之前,这份成本大概率还是得开发者自己先扛着。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.