AI Agent干活慢,很多时候不是模型不够聪明,而是底层算力撑不住。9月17日,第十一届华为全联接大会在上海开幕,360集团与昇腾AI联合打造了一套解决方案,专门冲着这个痛点去的。
这套方案的核心,是360智能体工厂与昇腾AI的深度协同。前者负责智能体的生成与编排,后者提供算力底座,目标很直接:让AI Agent在复杂任务执行、多智能体协作和长链路推理时跑得更快、更稳。
![]()
2小时的多角色协作,被压到20分钟
360智能体工厂是360智能体基础设施的核心组件,承担智能体生成与编排职能。它支持用自然语言快速生成智能体,并组建多智能体协作蜂群。
其中一项名为“蜂群多智能体协作技术”的能力值得关注。它支持多智能体多层嵌套、灵活组队与共享协作记忆,能实现任务自主规划与协同执行。落到具体数字上:原本需要2小时的多角色协作任务,被缩短至20分钟,效率提升6倍。
这个提速幅度背后,是AI Agent应用形态的变化。Agent正从单轮问答走向复杂任务执行,异步并行、多智能体协同、长上下文推理、高频工具调用逐渐成为主流。运行过程中,它要持续做任务拆解、规划决策、工具调用和结果反馈,对底层算力平台的稳定性、吞吐能力和响应速度都提出了更高要求。
昇腾做了哪些针对性优化
智能体场景里有两个典型挑战:长序列推理和频繁的KV Cache读写。昇腾AI针对这两点做了性能优化,具体手段包括:
- 长序列优化
- 吞吐优化
- 运行时优化
- 算子优化
这些优化带来的效果是降低首Token时延、提升整体吞吐效率,为高并发、长链路的Agent任务提供稳定支撑。
在深度理解、通用理解和智能体执行等典型场景中,搭载DeepSeek、Qwen、GLM等主流模型时,昇腾AI已具备良好的开箱性能,经过进一步优化后实现整体性能提升。
1000步不中断,成功率95%以上
基于昇腾AI的算力支撑,360智能体工厂在内测过程中已经跑出了一组数据:超过1000步的复杂任务连续执行不中断,任务成功率达到95%以上。
除了跑得动,还要让人看得懂。360智能体工厂采用透明化人机协同机制,把智能体的思考过程、任务规划路径和执行状态全程可视化,用户可以实时掌握任务进展与执行结果。支撑这一体验的,是底层的毫秒级响应能力。
从行业视角看,AI产业的竞争重心正在从“大模型竞争”转向“智能体竞争”。智能体的价值不只看模型能力,更依赖模型、工具、工作流与算力基础设施之间的协同效率。360与昇腾AI的这次联合,是智能体基础设施与国产AI算力协同发展的一次实践探索,也是双方继2026世界人工智能大会联合展示后的进一步深化落地。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.