最近这两天我在出差,没咋关注 AI。昨天晚上回酒店,打开最近常用的千问办公,发现它的模型选择框里多了一个新选项:标准模式,底层模型是刚刚发布的 Qwen3.8-Flash,嚯,这是新模型上线:
![]()
最让我吃惊的是,积分倍率只有 0.1x;上面的高级模式继续承接复杂任务,但在我看来,日常的很多任务,用标准模式就足够了。以前的现实问题是,Agent 能力越来越强,我们却未必敢把它一直开着,现在 0.1x 让这个问题消失了。
看了下千问办公的产品数据,在真实办公场景中,标准模式的单任务生成速度能提升约 100%,Token 消耗则平均减少 75%,看样子以后就是两种模式,标准和高级,95% 的日常任务由标准模式承接,余下 5% 的复杂任务交给高级模式。
事实上,对于每天写周报、做表格、整理会议纪要、查资料和生成方案这样的任务,都属于 95%,也就是说,你可以随便造了,让 Agent 随时在线。
Token 焦虑,是 Agent 普及路上的隐形账单
过去的 SaaS 软件通常按月或按席位收费,成本大体可以预期。Agent 的账单就不那么确定,像一块不断跳动的电表,一下干光额度就想停电了,要么充值,要么等额度恢复。同样一句“整理会议纪要”,背后可能包含文件读取、上下文检索、任务规划、多轮工具调用、自我检查和格式重组等等。用户看到的是一条指令,系统执行的却是一串连续工作。
现在 Agent 基本都进入了普通人的工作场景,任务更长,文件更多,调用频率也更高了。一次任务贵一点似乎可以接受,不节制的使用,Token 还是挺贵的,会影响 AI 在个人和企业的使用情况,甚至工作流程。
这年头,Token 焦虑人人有嘛,并且会影响你的使用习惯。和任何一个新技术类似,只有在边际成本足够低时,才会被放进高频流程;不用反复判断“这次值不值”,才可能把更多工作放心交出去。
生成速度同样重要。Agent 要连续完成多步操作,任何一环的等待都会累积,最后形成明显的体感落差。
所以,速度提升一倍与 Token 少消耗 75% 就很惊艳了,前者缩短等待时间,后者降低使用门槛和费用。两者同时发生,Agent 才能真正接近办公基础设施的使用方式:随时可用,随时能用。
模型的智能密度,以及和 Agent 的协同,决定 Agent 能不能“量大管饱”
扒了扒 Qwen3.8-Flash 的技术报告和数据,发现 Qwen 从 3.8 开始,确实脱胎换骨,无论是在智能体还是编程等核心维度上,都稳稳的在第一梯队。这种价格的 Flash 模型冲到这个位置,了不起啊。
开源版本 Qwen3.8-Flash采用了新的混合架构,主模型拥有 125B 参数,另有 51B 的 N-gram Embedding,每个 Token 只激活 6B 参数。它通过稀疏注意力、门控残差和新的优化方法,在保留模型容量的同时压低训练与推理成本。面向生产环境的版本以 Qwen3.8-Flash 提供服务,定位就是高频调用、工具工作流以及编程和协同办公助手。
什么是“智能密度”呢?可以理解为单位计算成本换来的有效能力。
参数规模很大,实际每次推理只调动其中一小部分;模型仍然能理解复杂指令、处理长上下文,并在工具调用场景中保持稳定。对 Agent 来说,这比单纯追求榜单分数更关键。
更关键的是,这次千问办公团队与千问大模型团队做了双向协同,这个很重要:模型侧围绕多步规划、工具选择、上下文压缩等办公场景进行训练调优;产品侧则通过推理优化和定制 Harness 架构,重新安排任务拆解、上下文管理和工具调度。模型更懂 Agent 如何工作,Agent 也更懂怎样发挥模型的长处。
这叫双向奔赴
这样的协同会减少很多看不见的浪费。一次不必要的工具调用、一轮无效重试、一段反复塞回上下文的历史信息,都会消耗 Token,也会拖慢任务。模型和 Agent 一起优化,训练、推理和产品执行链路一起调整,效率提升才有机会落到用户实际完成的任务上。
95% 的日常任务,为什么是一条“斩杀线”
现在斩杀线的说法很流行,咱也用一下。
通用 Agent 的功能正在快速趋同。谁能让用户用得更多、等得更少、又不必时刻计算 Token 额度,谁能更接近日常入口。
千问办公把 95% 的日常任务放进标准模式,意义正在这里。标准模式覆盖高频、明确、可快速完成的工作,高级模式处理长程推理和复杂交付。用户不必每次研究模型名称,也不用为了节省成本主动降低任务目标。
“斩杀线”这个词听起来很重口味,逻辑却很简单:当一种 Agent 能用十分之一的积分倍率承接绝大多数日常任务,其他产品仅仅做到“也能完成”是不够的。Agent 的竞争由功能可用,继续走向经济上也可用。如同水电油,如同云计算。
Agent 进入办公场景,从“敢不敢用”开始
对于日常办公,复杂研究、专业分析、长程执行是少数任务,肯定得用高级模式,人作为独立个体,需要承担挖掘需求、决策、审查、目标设定和责任,标准模式干啥呢?解决大量日常任务,快速、低成本但高效的完成,这是“体力活”。
Agent 想进入每个人的工作日程,既要变聪明,也要变得足够便宜、足够快。AI 的发展也没啥新鲜的,过去大家谈模型能力,就看更大的参数和更高的分数上;到了高频 Agent 阶段,智能密度、调度效率和任务成本开始共同决定产品体验。快一倍,省四分之三,95% 的日常任务交给标准模式。
从“敢不敢用”到“想用就用”,中间隔着的是一整个时代的基础设施重构。Qwen3.8-Flash 和千问办公只是其中的一个切片,却已经让我们看到了一点未来办公的轮廓:智能随手可得,而人的精力,终于可以只花在真正重要的事情上。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.