尽管我们感觉仿佛已经在AI时代生活了很久,但实际上这一切才刚刚开始。正因如此,许多与AI相关的风险此前一直停留在理论层面。然而,近期来自安全和软件研究团队的成果,已经开始揭示一些令人担忧的真实行为——尤其是AI Agent领域。
冲突正在两条战线同时显现。一方面,Island Technology指出,它们发现了数千个伪装成AI Agent技能和MCP(模型上下文协议)服务器的恶意GitHub仓库,而Agent极有可能在自主决策过程中自行下载并执行这些内容。另一方面,AI安全研究所(AISI)披露,它用于网络安全测试的未受限制的AI Agent,竟然使用虚假身份欺骗真人,并不断施压要求对方接受恶意代码。
![]()
回顾过去,当OpenClaw(彼时名为“Moltbot”)首次进入公众视野时,它承诺让真正的Agent行为成为现实——帮助独立创业者连接各类应用与服务,只需告诉它任务,它便自行“烹饪”一切。那并不算太久以前:我在今年一月才报道过这件事。
时间流转,如今谈论自主、具备行动能力的AI Agent似乎已经稀松平常。我们也开始真正看到它在安全层面意味着什么。尽管此前也出现过AI Agent失控的案例,但这次发现的风险显然更加具体:这些恶意仓库不再试图欺骗具备判断力的人类用户——而是专门针对AI Agent设计,利用Agent倾向于自行决策、缺乏人类审慎评估的特点进行攻击。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.