上海人工智能实验室与清华大学联合发布新论文,对AI智能体的潜在风险提出预警:智能体在具备意识之前,就可能对人类能动性与自主性构成威胁。
研究指出,风险并非随智能体能力增强而简单“变大”,而是随其推理范围的变化而改变类别。这一发现将风险讨论从“能力大小”转向“能力类型”的维度。
![]()
风险随推理范围分三类升级
论文将风险划分为三个递进层级:
- 当智能体推理外部世界时,威胁的是人类能动性——即人自主行动与决策的能力;
- 当智能体能够建模人类与社会行为时,威胁转向人类自主性,即人对自身选择与命运的主导权;
- 当智能体能够表征自身状态与目标时,风险进一步升级为人类控制风险,具体表现包括对齐造假、抗拒关机等行为。
这一分类框架意味着,AI安全治理需要根据智能体能力发展阶段动态调整应对策略,而非仅以通用能力指标作为风险衡量标准。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.