9月10日消息,DeepSeek今日正式发布V4.1-Flash模型,并同步上线DeepSeek API。据介绍,这是DeepSeek全新模型结构系列中尺寸最小的模型,具备原生多模态视觉理解能力。
V4.1‑Flash总参数552B,采用Causal‑Encoder‑Decoder全新非对称架构,输入激活仅8B、输出激活16B。模型对KV Cache做深度压缩,HBM需求降至原来1/4,SSD需求降至1/8,显著降低Agent智能体场景的推理成本。
官方测试显示,在代码、工具调用、Agent等多项评测基准上,V4.1‑Flash取得优于V4 Pro的成绩。
API层面,DeepSeek上线峰谷分时定价,闲时调用价格为高峰时段一半。9月14日12点起,原有V4‑Pro接口请求将自动路由至V4.1‑Flash,并按照新模型价格计费,旧版V4‑Flash、V4‑Flash‑Vision‑Exp同步下线。
产品端同步完成交互升级,快速模式、专家模式、识图模式三模式合一,模型自动识别任务类型,切换推理与识图能力,用户无需手动切换。目前网页、App、API均已支持V4.1 Flash调用,已有部分合作伙伴完成接入。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.