让AI读材料、写报告、改代码,今天开始可以更快、更省了。
8月26日晚,阿里发布Qwen3.8-Flash,并首发上线千问办公。真实办公场景测试显示,千问办公标准模式单任务生成速度提升约100%,Token消耗平均减少75%。用户即日起即可通过标准模式体验新模型,未来千问办公将主要提供“标准”和“高级”两种模式,其中约95%的日常任务都可以交给标准模式完成。
![]()
对于用户来说,这次升级最直观的变化就是“少等一会儿、少花一点”。
比如整理一份长材料、提炼会议重点、写报告、修改文字,都可以直接交给千问办公处理。遇到更复杂的任务,再使用高级模式。
为什么新模型能做到又快又省?
Qwen3.8-Flash采用MoE架构,主模型有1250亿参数,但每个Token平均只激活约60亿参数。
简单说,就像一家公司有很多员工,但来了一个任务,不需要所有人一起上,只叫最合适的一部分人干活。
同时,新模型原生支持26万Token上下文,最高可扩展到100万Token。面对一大摞资料,AI可以先找重点,而不是每次都把所有内容重新算一遍。
官方称,Qwen3.8-Flash训练开销约为上一代Qwen3.7-Plus的1/9,API输入价格为每百万Token 1元、输出3元。
这背后其实是大模型竞争的一个新变化。
过去大家喜欢问:“哪个模型最聪明?”
但当AI真正进入办公、编程和企业业务后,问题变成了:
这么强的AI,能不能天天用?
千问办公这次不仅升级了模型,还针对多步规划、工具选择、上下文压缩等办公场景进行了专门优化,让模型和AI Agent配合得更顺。
说到底,就是让AI少走弯路。这对于杭州的人工智能产业也有现实意义。
从电商、软件到智能制造、智能家居、智能穿戴,杭州正在出现越来越多AI应用场景。场景越多,企业对模型的需求就越像日常水电——不是偶尔用一次,而是天天用、大量用。
因此,模型能不能降低成本、提高速度,会直接影响企业愿不愿意把AI真正用起来。
与此同时,阿里还开放了Qwen3.8-Flash-Next模型权重,并将其定位为下一代Qwen4系列模型的架构雏形。
模型更省,企业更敢用;模型更开放,开发者更容易在上面做应用。
从今天可以直接使用的千问办公,到提前开放的下一代模型,大模型正在从“技术产品”加速变成普通人和企业真正用得上的基础工具。
对杭州而言,这意味着丰富的产业场景,又多了一层可以接入的AI能力。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.