AI智能体(AI Agent)正在从概念走向落地,但安全问题始终悬而未决。NVIDIA近日对AI智能体技术栈进行了分层拆解,给出了一个明确答案:安全控制不应放在提示词(Prompt)或编排逻辑(Harness Logic)里,而应下沉到运行时层(Runtime Layer)之下,才能形成真正的强制力。
五层架构,安全位置明确
![]()
NVIDIA将AI智能体技术栈划分为五个功能层,并指出安全控制必须位于边界之下的运行时层。这一设计逻辑在于:提示词可以被绕过,编排逻辑可以被篡改,只有运行时层才能提供权威的、不可跳过的执行保障。
为什么不是提示词层?
提示词层面的安全约束本质上是一种"建议",模型可能遵循也可能忽略。而运行时层的安全控制则是"规则",在系统层面强制执行。NVIDIA认为,这种架构上的差异决定了安全措施是形同虚设还是真正有效。
这一分层思路为AI智能体的安全设计提供了一个可操作的参考框架,也意味着安全团队需要重新思考防护措施的部署位置。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.