![]()
就在刚刚,尽管超过了 “中旬”,但 “梁圣”也依然在7月公布了正式版。
智能纪元AGI 7月31日消息,一小时前,Deepseek网站公布,DeepSeek V4 Flash 更新到正式版,Agent 能力大幅提升,针对Codex做了适配,性能超过了 V4 Pro 的 Preview 版本。
具体来说,DeepSeek-V4新版本原生支持 Responses API,单模型结构和参数规模没有变化,主要重新进行了后训练。
DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。而本次只升级 API 接口,DeepSeek App 和网页端没有更新。V4-Pro 正式版仍未发布,官方称将尽快上线。
评测成绩方面如下:
- Terminal Bench 2.1: 82.7
- NL2Repo: 54.2
- Cybergym: 76.7
- DeepSWE: 54.4
- Toolathlon verified: 70.3
- Agent Last Exam: 25.2
- Automation Bench (Public): 25.1
- DSBench-FullStack: 68.7
- DSBench-Hard: 59.6
先回顾一下,DeepSeek-V4这几个月发生了什么。
4月24日:V4预览版发布,权重开源
Pro和Flash一起放出来,全系百万上下文,权重直接开源,适配了国产芯片。开发者圈子里当天就开始拉代码跑起来。从这天起,DeepSeek不再只是梁文锋自己的实验室了。
4月底到5月:开始找外面的钱
此前DeepSeek只花母公司自有资金。算力、招人、机房三头烧钱,顶不住了,首轮对外融资启动,头部机构陆续进场。
5月22日:API降价四分之三
V4-Pro接口价格直接砍到原来四分之一。企业端和独立开发者涌入,国内模型接口价格被拉到新的基准线。
6月中旬:首轮融资关闭
约500亿人民币,投后估值超500亿美元。DeepSeek梁文锋本人是最大出资方,超过200亿元;腾讯、宁德时代跟投。股权结构上创始人保留强控制。钱到账后,算力基建和IDC岗位大规模开招,自建数据中心进入实质筹备。
6月底:Pre-IPO消息传出,同时推峰谷计费
首轮融资刚关六周,市场传出第二轮消息,目标至少100亿,估值继续往上抬。找会计师事务所进场整理账目,IPO准备已经开始。同一时段,V4正式版规划对外公布,工作日高峰时段接口价格翻倍,用价格杠杆缓解算力挤兑。
7月19日到31日:V4正式版灰度上线
Flash正式版先开放公测,Pro版还在打磨。老版本模型进入下线倒计时。
7月26日:第二轮融资暂停
梁文锋口头通知部分投资方,融资协议签署暂时搁置。没有说终止,但一级市场上已经炸开了锅。
今天还有两个消息:一个是DeepSeek计划在内蒙古建设大型 AI 数据中心,增加 1GW 算力;二是梁文锋的幻方投资了长鑫科技,得到了超过8亿的回报。
过去三个月时间线,我们拆开看:产品从Preview到正式版,一路开源降价抢开发者。资本侧从零外部融资到首战500亿,六周后就推进Pre-IPO,中间插进来第二轮被迫踩刹车。几条线全撞在一起了。
当前,DeepSeek面临两个重要事件:
1、Kimi K3重现了DeepSeek时刻,对于梁文锋来说,这是一个紧迫找回“主场”的时刻。尤其国内对于开源AI模型的支持力度,这会影响接下来DeepSeek商业化。
2、智谱 GLM 上调接口定价、MiniMax 全新 H3 模型落地,行业竞争持续收紧,DeepSeek 虽仍稳坐第一梯队牌桌,但被动挤压的态势已然显现。在此局面下,它必须推出具备足够冲击力的产品,打通商业化营收闭环,为后续上市进程进行铺路。
最后谈一下,V4这四个月,从预览到Flash正式公测,没有发布会,没有高管站台。
但技术取舍很清晰:每一步都在换东西,开发者数量,或者资本市场的信心。
先看技术侧做了什么。百万上下文铺到全系,Pro和Flash双线并行,重度研发和轻量商用各走一条。MoE架构压推理成本,KV缓存做减法。
而且,国产芯片适配同步完成。
放在2026年4月的时间点上,长文本太贵、私有化部署难、国产算力跑不动这三个老问题,V4一次性给了答案。
但答案不是免费的。
API定价一度砍到原来四分之一,Flash定价更低,先把中小开发者拉进来。后面再上峰谷调价,高峰翻倍,用价格手段削峰填谷。
逻辑很直白:开发者拿开源权重做二次开发,调用链留在DeepSeek的API上,每跑一次都是流水。这笔账,养的是未来算力业务的底盘。
产品节奏和融资节奏完全同步。4月预览版发布、降价、开源,同一个月启动首轮外部融资谈判。6月500亿融资到账,算力扩张等着花钱。7月Flash正式版加速推送,补Agent能力,补代码自动化,全是企业客户掏钱买的场景。技术迭代不再跟实验室排期走,它跟钱到账的时间走。
Flash先上、Pro后上的顺序也说明问题。轻量版抢先公测,旗舰版继续打磨。
算力就这么多,先保能带来现金流的产品线,高成本的精品往后排。技术优先级排不过商业优先级。
这就撞上了开源模型的结构性矛盾。
你开源,全行业拿去用,自己的技术壁垒就薄了,只能靠API调用和私有化部署赚钱。但扩张算力、抢芯片、招人,全要靠融资续命。
对行业敞开底牌,对资本交出估值,两边同时喂,技术路线只能来回摆。
但PPIO(派想未来)创始人、CEO姚欣告诉我,梁文锋的DeepSeek进行融资,绝不是为了钱,其个人财务、企业体量早已无需依靠商业化、上市获利,融资的核心、初心始终是落地AGI,而非追逐商业利益。
“留住人才、做Coding,梁文锋的这两个判断跟我的看法是很像的。奔向AGI,不止是模型,今天要有辅助手段:第一个需要有资本化上市用激励团队,第二个需要Harness、Agent形成收入,才能实现AGI。我觉得他的初心和方向和路径依然没有变,他有能力商业化,但不是追求最大商业化,这跟其他纯商业型公司背后有大量VC投入、一轮轮涨估值,然后要去讲一个更大的故事,还不太一样。”姚欣称。
在姚欣看来,DeepSeek V4系列模型大幅降价75%的背后,不是抢占市场、收割利润,而是倒逼行业加速迭代、推动AI技术全民普及,推动整个国内AI产业快速成熟。
当DeepSeek V4跑到了国产开源模型能摸到的最高位置。但它证明的事情可能让人不太舒服:
今天做大模型,技术本身不再是目的,它是资源调度的中间变量。
DeepSeek算力账、人才账、融资周期,决定你先做什么、后做什么、不做什么。
你怎么看DeepSeek V4更新?
©本文为原创内容
未经授权,禁止转载
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.