DeepSeek预告大幅涨价,“斩杀线”效应持续发酵:AI大模型告别“赔本赚吆喝”
8月6日,DeepSeek发布一则简短却震动了整个AI圈的公告:“计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。”
这距离DeepSeek 7月中旬首次引入峰谷差异定价机制仅约三周。从年初的“价格屠夫”接连降价,到如今预告大幅涨价,DeepSeek的定价策略反转,折射出国内大模型行业正在经历一场深层次的逻辑重构。
从“骨折价”到“大幅涨”,一年内价格过山车
回顾2026年,DeepSeek的API定价经历了一条陡峭的曲线。
4月25日,DeepSeek-V4-Pro模型API开启限时2.5折优惠活动,缓存命中输入价格降至0.25元/百万tokens。5月23日,DeepSeek又宣布优惠结束后正式调整为原价的四分之一,降幅高达75%。这一系列降价被外界视作国内大模型价格战走向白热化的标志。
转折发生在6月底。DeepSeek向用户发送邮件称,V4正式版发布后将同步调整API定价策略,引入峰谷定价机制,高峰时段调用价格直接翻倍。根据当时披露的方案,DeepSeek-V4-Pro在高峰时段百万tokens输出价格将从6元涨至12元。
目前,DeepSeek执行峰谷分时计费,工作日高峰时段(9:00-12:00、14:00-18:00)价格为平时的2倍。现行价格方面,V4-Flash模型输入(缓存未命中)1元/百万Token、输出2元/百万Token;V4-Pro模型输入3元/百万Token、输出6元/百万Token。
对于此番预告的“大幅涨价”,高盛在研报中认为,这并非需求走弱,反而反映出国内AI模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战逐步回归更理性的定价框架。
V4 Flash横空出世:单日8万亿Token、登顶全球第一
在宣布涨价的同时,DeepSeek-V4-Flash正式版已于7月31日上线公测。该模型延续2840亿总参数、130亿激活参数和百万Token上下文能力,通过新一轮后训练大幅增强了Agent能力。
市场对这款新模型的热情超出了多数人的预期。
全球最大AI模型聚合平台OpenRouter的数据显示,在7月27日至8月2日这一周,DeepSeek V4 Flash以7.22万亿Token的调用量位居全球第一。调用量排名前五的模型均为中国大模型——DeepSeek-V4-Flash、小米MiMo-V2.5、腾讯Hy3、DeepSeek-V4-Pro与智谱GLM5.2包揽了前五席位。
更惊人的数据来自海外开发者平台OpenCode:8月1日当天,DeepSeek V4 Flash在其平台上单日处理Token总量达8万亿,其中5万亿来自免费试用额度,3万亿来自开发者付费调用。
巨大的调用量甚至一度压垮了服务。8月4日,DeepSeek V4 Flash因前所未有的访问量出现容量不足问题,官方API上午几乎不可用。DeepSeek回应称问题已解决,服务已恢复。
“斩杀线”效应
V4 Flash真正引发行业震荡的,不仅是调用量,更是其“性价比”对全球AI模型竞争格局的重塑。
在国际AI基准测试机构Artificial Analysis的测评中,DeepSeek V4 Flash最新版本的智能指数仅比GPT-5.6 Luna(最高51分)低1分。但在成本上,差距是断崖式的:DeepSeek V4 Flash跑完一次基准测试任务仅需0.03美元,而Anthropic旗舰模型Claude Fable 5需3.15美元——DeepSeek便宜超过100倍。
“斩杀线”一词由此而来。 舆论普遍认为,DeepSeek价格远低于海外闭源模型,但性能却能接近,这意味着其对大部分模型画出了一条“行业生死线”。AI企业要么降低价格匹配DeepSeek,要么投入巨资开发更强模型,不然就可能被淘汰。
彭博社评论称,中企带来的新竞争格局,标志着任何既无法推出领先技术、又无法打破市场价格的企业都将面临淘汰。
如今,DeepSeek和梁文峰选择暂时放竞争对手一马。
行业告别“赔本赚吆喝”,商业化进入深水区
DeepSeek的涨价并非孤例。今年以来,阿里云、腾讯云、百度智能云、智谱AI等国内头部厂商已集体调价。智谱CEO张鹏曾在业绩说明会上表示,2026年一季度智谱API调用定价提升83%,调用量仍增长400%,呈现“量价齐升”态势。
过去两年,为抢占市场份额,各家疯狂压低API单价,甚至推出大规模免费额度。而进入2026年下半年,算力供需、芯片采购成本、运营成本持续走高,单纯靠低价换规模的模式难以为继。整个行业的逻辑,正从“拼低价抢用户”逐步转向“成本可承受前提下的商业化”。
值得注意的是,在宣布涨价的同时,市场传出DeepSeek已重启第二轮融资的消息。据报道,本轮计划募资500亿元,投前估值约5000亿元,预计8月下旬完成签约。此前DeepSeek已完成首轮外部融资,腾讯、宁德时代、网易、京东等参与投资。
相关报道:
融资、提价,DeepSeek终于打算激进扩张了
21世纪经济报道记者 赵云帆
就在上周DeepSeek V4-Flash正式版发布并“技惊四座”之后,本周,关于DeepSeek的两大消息又接连传出。
8月5日,《财经》报道,DeepSeek计划以5000亿元人民币投前估值启动新一轮融资,融资规模约为500亿元人民币。仅两个月,DeepSeek估值就由首轮超3500亿元人民币提升约43%。
经21世纪经济报道记者向部分投资人核实,DeepSeek启动新一轮融资确有其事,但主要是面向老股东以及上一轮未能参与的备选投资者。对新一轮投资者的审核依旧趋于严格,对外部新投资者相对封闭。
与此同时,8月6日,DeepSeek宣布即将对全部API接口服务定价进行整体上调,并明确“涨幅较大”。
两者似乎并非孤立事件——其指向DeepSeek可能开启的新一轮扩张计划。
全球大模型聚合平台OpenRouter最新周榜(7月27日至8月2日)显示,DeepSeek V4-Flash以7.22万亿Token的周调用量登顶全球第一,小米MiMo-V2.5以6.3万亿Token位居第二。
而在此前一周(7月20日至7月26日),DeepSeek V4-Flash、V4-Pro等多款模型已经紧随MiMo-V2.5之后,在OpenRouter API调用榜单中呈现“屠榜”态势。
本周,深度求索公司发布公告称,DeepSeek V4-Flash API在8月4日上午出现性能下降情况,原因系API调用量激增,目前问题已解决,服务已恢复。
这也是继2025年春节前后DeepSeek横空出世以来,该公司官方API时隔一年半再次出现大规模服务承压。
值得注意的是,由于DeepSeek V4同时具备低参数、低激活的特点,以及比肩头部大模型的综合性能,在许多企业级应用场景中,使用者近期重新开始对DeepSeek系列模型进行本地化部署和第三方接口部署,其在很大程度上分流了DeepSeek官方API的负载压力。
换句话说,OpenRouter的数据甚至还低估了DeepSeek的实际影响力。
随后,DeepSeek的涨价消息如期而至。
8月6日,DeepSeek在开放平台发布公告称,计划在近期整体上调DeepSeek API服务的定价,预计涨幅较大。而在7月中旬,DeepSeek已经预告将对官方API调用价格进行峰谷定价调整,以缓解瞬时调用压力,实现削峰填谷。
业内人士则向记者分析,该次调价大概率会引入峰谷定价,并同步提高整体价格。
除价格之外,媒体报道称,DeepSeek计划将所有部门规模翻倍,并开始增设数据、芯片等相关部门的岗位。
虽然梁文锋仍然强调团队克制,但至少从外界看来,DeepSeek已经不再是那个科技圈眼中低调、克制的AI大模型实验室了,其彻底变成了全球AI大模型巨擘。
在全球科技圈,DeepSeek等中国模型已经明显开始对Anthropic Claude、OpenAI GPT系列模型进行份额切割。
近日,成功投资优步(Uber)的知名硅谷天使投资人Jason Calacanis在一档播客节目中透露,Anthropic、OpenAI的数个重要企业客户近日开始转向DeepSeek、Kimi等中国大模型。
“我说的是那些投入五千万美元甚至上亿美元(Token费用)的企业,他们正在持续从Anthropic和OpenAI流失,因为他们担心这些公司窃取应用层业务,并转而成为自己的竞争对手。”Jason Calacanis表示。
值得注意的是,就在此前,优步已经开始限制团队使用智能体编程,因其年度Token预算早在数月前就已用罄。
Jason Calacanis还列举了Lovable(零基础编程智能体)、ElevenLabs(AI语音头部企业)、Figma(AI设计智能体)等倒向中国模型的企业,并指出自己团队在部署中国模型的情况下,成本下降了80%到90%。
无独有偶,近期海外聚合平台数据显示,Anthropic作为大模型标杆企业,其ARR(年化收入)增速自7月开始已经退坡——其5月公开披露的ARR为470亿美元,TickerTrends追踪数据显示7月ARR已至741亿美元,但月度增速由5月约51%降至近期约8%。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.