今天,DeepSeek 正式发布全新 DeepSeek V4.1 Flash 模型,并同步上线 DeepSeek API。
这款定位于全新模型结构系列中“最小尺寸”的模型,带来了超出外界预期的能力跃迁:不仅原生支持多模态视觉理解,更在智能水平、推理速度、吞吐效率上实现全面升级。
据悉,DeepSeek V4.1 Flash 是一款 552B 参数 MoE 模型,采用全新的 Causal-Encoder-Decoder 非对称结构,输入激活仅 8B、输出激活 16B,在保持强大能力的同时显著压低运行成本。官方表示,这一架构面向未来更大参数模型而设计,目标是让模型能力上限更高、速度更快、吞吐更大,并具备更强扩展性。
值得关注的是,凭借新的预训练方式和更大规模强化学习后训练,V4.1 Flash 在多项基准测试中已超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。
对于开发者和企业用户而言,更低成本同样是本次升级的核心亮点。新一代模型大幅压缩 KV Cache,与上一代相比,HBM 需求降至四分之一,SSD 需求降至八分之一;相较初代模型,KV Cache 更已缩小 437 倍。在 Agent 使用场景中,缓存命中费用常常占据较高比例,这意味着长上下文、多轮调用、代码助手、办公智能体等应用将获得更可控的成本结构。
API 使用也进一步简化,用户只需将模型名称改为 deepseek-flash,即可调用最新 V4.1 Flash。旧版 V4 Flash 与 V4 Flash Vision Exp 已下线,相关模型名将暂时路由至 V4.1 Flash。
由于多方测试显示 V4.1 Flash 已在性能、费用、速度和总用时等指标上全面超越 V4 Pro,DeepSeek 还宣布将有序下线 V4 Pro。9 月 14 日 12:00 后,在 V4.1 Pro 上线前,访问 deepseek-v4-pro 的请求将统一路由至 V4.1 Flash,并按新模型单价计费。
价格方面,DeepSeek 借助架构创新进一步下调 V4.1 Flash API 定价,并继续采用峰谷定价机制,闲时价格为高峰时段的一半,新价格已于 9 月 10 日 12:00 生效。
![]()
与此同时,腾讯 WorkBuddy、CodeBuddy 以及 OpenCode 已作为官方合作伙伴全量接入。
PS:
9-10月来了:杭州《视频号精准获客》、杭州《Codex超级实战课》、广州“高客单行业获客+激活”异业合作私享会、长沙私域私享会、北京某知名快消品牌闭门会,欢迎加入会员一起参加,可点击文末阅读原文查看活动详情。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.