![]()
2026 年 8 月 12 日,DeepSeek V4 Pro 正式版上线。目前 DeepSeek 没有发布公众号文章、也没有技术博客、更没有推文。唯一迹象是官网 API 定价页面上的一行字变了,“deepseek-v4-pro”后面的版本号从预览版变为了 DeepSeek-V4-Pro-0813。
这也意味着从 2026 年 4 月就开始以预览版身份运行的旗舰模型终于正式转正。
据了解,DeepSeek V4 Pro 是一个混合专家(MOE)模型,总参数量达到 1.6 万亿,每一个 token 激活 490 亿参数,上下文窗口为 100 万 token,最大可以输出 38.4 万 token,这个规模放在全世界 AI 模型里位居第一梯队。此前所有第三方测试跑的都是预览版本,预览版在 Hugging Face 上已经被下载多大 140 万多次。
正式版上线之后的价格与非高峰时段价格保持了一致,这一价格其实就是 2026 年 5 月份已经永久降价为原价四分之一后的标准价格,具体来说每百万输入 token 的收费为 0.435 美元,输出收费为 0.87 美元,缓存命中的输入收费只需要 0.003625 美元。
相比之下,Anthropic 的 Claude Fable 5 每百万输入收费为 10 美元,输出收费为 50 美元,它俩整整差了两个数量级。按照 DeepSeek 目前的定价,算下来还不到 Claude Fable 5 的 2%。
要是按完成单个任务的成本来算,差距就更加明显。有机构测试过,使用 Claude Fable 5 完成一个基准任务花费 3.15 美元,使用 DeepSeek V4 Flash 只需花费 3 美分,两者差了 100 倍。DeepSeek-V4-Pro-0813 版本的单任务成本目前还没人测过,但是价格体系没变,情况应该大致类似。
之所以价格差距能拉这么大,主要和架构设计有关。DeepSeek V4 Pro 使用了两种注意力变体,第一种叫做压缩稀疏注意力,另一种叫做重度压缩注意力。
按照 DeepSeek 的说法,这套架构能够把单 token 推理计算量降到 V3.2 代的 27%,KV 缓存降到了原来的 10%。这对于 100 万 token 的上下文窗口来说,能够节省的成本非常可观,因为推理效率高了,定价空间自然也就出来了。
DeepSeek 自己也开展了基准测试,即在 10 个智能体评测上和 Claude Fable 5 对比。去掉一个差距最大的之后(Humanity's Last Exam,DeepSeek V4 Pro 落后 10.6 个百分点),剩下 9 项之中 DeepSeek 平均落后 2.8%,有 2 项 DeepSeek 还赢了。
但是这些数据是 DeepSeek 自己测的,使用的是自家还没对外开放的评测框架,至于这两个内部测试集也没有公开榜单可以验证,也就是说 DeepSeek-V4-Pro-0813 版本的真实表现,得等第三方评测跑过才知道。
![]()
图|DeepSeek V4 Pro 与其他前沿模型跑分对比(来源:X)
DeepSeek V4 Pro 在 API 里开放了三个模式:分别是普通模式、高推理模式和最高推理模式。其中,最高模式会推高模型推理能力的边界,API 能够同时支持 OpenAI 和 Anthropic 两种格式的接口,之前已经在这两个生态里开发的开发者无需改代码就能切过来,同时支持工具调用、结构化 JSON 输出这些能力。
DeepSeek V4 Pro 正式版上线之后,DeepSeek V4 系列的产品结构变得更加清晰:一方面,Flash 版本做高频、高并发的流量,主打一个价格便宜;Pro 版本负责把算力集中在更复杂的推理、长上下文编码和智能体任务上。一些在 AI 开发的国内公司,很多都已经在进行搭配使用。
但是 DeepSeek 的定价页面上还挂了这样一句话:那就是近期会有一次“显著的价格调整”。至于具体涨多少以及什么时候涨,目前还没有公布,眼前这种低价窗口到底还能够开多久也不太好说。
与此同时,多家聚合平台的数据显示,2026 年 7 月 DeepSeek 模型 Token 调用规模位居全世界 AI 模型第一梯队,在部分榜单中仅次于 Anthropic 的模型,DeepSeek 的业务增长依托真实的开发者调用,迄今为止没有举办过任何的大型媒体发布会,主要是在公众号官宣,有时附带发一发技术博客。
众所周知,DeepSeek 的算力储备不算大,其创始人梁文锋亲自披露过这个数据。他在 2026 年 7 月的一次投资人交流会上提到,当时 DeepSeek 拥有大约 2 万张 H100 等效算力。这个数字跟海外 AI 头部大厂动辄几十万甚至上百万卡集群相比,的确不在一个量级。
但是梁文锋也说这个数字是动态的,他们一直在努力采购更多算力,打算“在合理价格内能买多少卡就买多少卡”。与此同时,DeepSeek 还计划建设 GW 级别(相当于数十万张卡规模)的自建算力中心,前不久其为内蒙数据中心招聘人员正是这一迹象的显露。
DeepSeek 还与华为合作,拿到了 16000 张昇腾 950 算力卡,用于软件生态验证与落地。并且第三方机构已经在国产算力集群(昇腾 910C)上完成了 DeepSeek V4 Pro 的全参数后训练,这都说明国产算力正在逐步承担更重的任务。
目前 DeepSeek 的权重依然是 MIT 许可证,正式版的权重什么时候放出来还不一定。但是按照 V4 Flash“API 先跑、权重随后跟上”的节奏,估计应该只是时间问题。第三方评测机构目前正在排队测 DeepSeek-V4-Pro-0813 版本,等到数据出来就能看清 DeepSeek 这次到底提了多少。
参考资料:
https://api-docs.deepseek.com/quick_start/pricing/
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.