8月17日凌晨,DeepSeek完成了一次三重变阵。
峰谷定价生效、V4-Pro正式版转正、Harness开源——三件事撞在同一天。
最扎眼的是那个数字:V4-Pro缓存命中输入从0.025元涨到0.30元/百万tokens,涨幅1100%。输出从6元涨到27元,涨幅350%。V4-Flash输出从2元涨到9元。
那个把大模型价格打到"白菜价"的DeepSeek,正式收刀了。
峰谷定价,AI算力也开始"错峰用电"
每天9:00-12:00、14:00-18:00是高峰,其余时间半价。
这逻辑跟电力行业一模一样——白天贵,晚上便宜,把批量任务挪到凌晨跑。
据高盛研报分析,这次调价不是需求走弱,而是算力资源趋紧。调用量暴增是直接推手——8月1日V4-Flash单日处理Token总量达8万亿。中国日均Token调用量已突破140万亿,较2024年初增长超千倍。
V4 Pro正式版,到底强在哪?
版本号0813,1.6万亿参数、每词元激活490亿。
DeepSWE基准从12.8飙到62.7,涨了约4.9倍。九项智能体基准接近Anthropic的Fable 5。官方说,不再强调"更会答题",而是强调"更会把一件事干完"。
Harness开源,才是真正的"杀招"
MIT协议,2天累计约9.5万Star、11.4k Fork。
核心公式:Model + Harness = Agent。一切皆插件,支持40+家模型供应商。
模型可以贵,但框架免费开源——你用Harness搭的系统,底层跑的还是DeepSeek的API。但开发者也完全可以在同一个框架里跑Claude或其他国产模型。
开发者怎么办?
算一笔账:日均调用V4-Pro 100万次,每次输出2000 tokens,高峰期占比70%。
旧价格日均输出费约12000元。新价格峰谷混合约22950元,日均涨幅约91%。
探哥说过: "未来真正能赚钱的人,并不是手头拥有多少钱的人,而是拥有算力的人——又叫Token工厂。"(2026-06-25直播)
许教授也说过: "AI时代就三件事——降本、提效、找机会。没那么多花招。"(2026-06-27实战营1)
实操建议:把批量任务挪到夜间跑、用Flash做80%日常任务、利用缓存优化(实测长会话缓存命中率约80%)。
从通问AI的实践来看,很多团队只关注模型能力,却忽略了调用策略是否合理。一个好的Agent系统,会动态决定什么时候调用什么模型。
行业风向变了
DeepSeek不是唯一涨价的。智谱、月之暗面、MiniMax、阶跃星辰今年都已上调API价格。
算力是真金白银的硬成本。DeepSeek估值约5000亿元,IPO筹备中,商业化变现是绕不开的命题。
靠烧钱换量的阶段正在结束。未来的竞争,不是比谁更便宜,而是比谁能让开发者愿意为能力买单。
本文信息整理于2026年8月17日。数据来源:DeepSeek官方文档、IT之家、第一财经、36氪、高盛研报、国家数据局。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.