8月26日晚间,阿里发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿(6B)即可获得超越Claude Opus4.6的前沿性能,创下模型效率全球新基准。Qwen3.8-Flash今晚将首发上线"千问办公",开发者和企业也可通过千问AI平台获取新模型API服务。
Qwen3.8-Flash的最大看点,是训练与推理成本的"断崖式下降"。得益于架构和训练的革新,Qwen3.8-Flash训练成本较Qwen3.7-Plus骤降近90%,推理成本同样大幅下降,每百万Tokens输入仅1元,输出3元,价格最低至DeepSeek-V4-Flash的1/3。这意味着,无论对头部企业还是中小开发者,接入主流大模型能力的边际成本正在被压缩到"几乎可忽略"。
在性能对标上,Qwen3.8-Flash以60亿激活参数实现"千亿级模型效果",这意味着模型架构在MoE(混合专家)路径上已经走通"小激活、强性能"的工程化路线。开源协议下,开发者可以下载模型权重进行本地部署和二次训练,这意味着国内大模型生态将进一步"普惠化"——从头部企业到中小开发者,都能用极低的推理成本接入主流水平的模型能力。当训练成本降低九成,模型迭代速度也将明显加快,应用层创新的"密度"将显著提升。
对应用层而言,推理价格被打到DeepSeek-V4-Flash的三分之一,意味着AI Agent、企业知识库、智能客服、AI办公等高频调用场景的"Token经济"将出现根本性改变。当大模型推理进入"毛分钱时代",AI应用的商业模型有望从"按调用次数计费"走向"按业务结果计费",SaaS化、行业方案化的盈利空间被显著打开。同时,Qwen3.8-Flash的发布将与近期阿里在AI基础设施、芯片、网络等领域的全栈布局形成协同——上游有阿里云、磐久AI服务器、平头哥芯片,中游有Qwen系列模型矩阵,下游有千问办公、淘宝问问、钉钉AI助理等应用场景。
从产业竞争看,Qwen3.8-Flash的开源降价,将把国内大模型竞争推向"以效率换市场"的新阶段。在DeepSeek、月之暗面等同行持续推新降价的背景下,阿里通过架构级创新把成本曲线整体下移,传递了"开源+普惠"战略的清晰信号。可以预期的是,未来一段时间,围绕MoE架构、长文本理解、多模态能力、工程化部署的竞争将更激烈;与此同时,应用层的创新也将因基础模型成本的下降而进入更活跃的阶段。
本文首发自官网 大湾区经济网
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.