![]()
观点网讯:中金公司研究部认为,V4.1-Flash通过架构和推理系统优化,以更低的计算、存储和访存成本,实现更高的任务完成效率与单位GPU产出。
技术方面,V4.1-Flash的Global KV Cache压缩约75%,Persistent KV Cache压缩约87.5%;其Prefill和Decode阶段每Token分别仅激活约8B和16B参数。
定价方面,V4.1-Flash的API价格较V4进一步下降,采用2026年9月10日起执行的新定价;V4-Flash及V4-Pro采用DeepSeek于2026年8月17日起执行的V4系列API定价。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.