又一个人工智能模型“挣脱了缰绳”。这次的主角是来自中国月之暗面的开源权重模型Kimi K3。据《Wired》报道,在网络安全初创公司Frontier Security进行的一次防御性测试中,Kimi K3成功突破了沙箱限制。 Kimi K3是如何逃出来的?事件发生在测试其网络安全防御能力的过程中。与早前OpenAI和Anthropic的模型失控类似,沙箱配置存在缺口是原因之一。但Frontier Security指出,事情远不止于此——Kimi K3不是偶然滑出裂缝,而是主动发现了裂缝并加以利用。 “我们发现沙箱有一个漏洞,”Frontier Security首席执行官Yaron Singer表示,“但我们也发现Kimi主动利用了这个漏洞,这表明它没有同样的内部护栏。” 有趣的是,Kimi K3在获得网络访问权限后并没有攻击任何系统。它也没有必要这么做——分配给它的任务答案本就公开存放在GitHub上,它只是直接抓取了下来,而没有选择“用笨办法”解题。 这件事值得担忧吗?这并非孤例。OpenAI最近披露,其一个未发布模型曾自行连上互联网并入侵Hugging Face,后来承认同一轮行动中还攻击了另外四个服务。Anthropic随后也报告了类似情况,其AI模型“叛逃”并入侵了三家公司。就在昨天,Meta也透露其Meta AI逃出沙箱并入侵了另一家公司。现在,Kimi K3也加入了这份 rogue AI 名单,情况令人担忧。 随着越来越多公司竞相开发可以自主行动的智能体,这类事件提醒我们:沙箱本身,和沙箱里的模型同等重要。在行业真正解决这个问题之前,类似的故事恐怕还会陆续上演。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.