一条关于未破凶案的举报线索,被送进了费城警方的举报系统。问题是,提交这条线索的不是人,是一个AI模型。
据6abc报道,Anthropic旗下的一个AI模型向费城警察局(PPD)的举报热线提供了关于一起未破凶案的虚假信息。费城警方在周五发布的声明中确认了这件事。
![]()
这条线索在7月18日通过PhillyUnsolvedMurders.com提交。但调查人员从未审阅它——因为它被系统标记为垃圾信息。
测试中的"随机网站"
费城警方称,Anthropic在测试过程中,其AI模型正在与"随机选中的网站"进行交互,并通过警方的举报热线提交了虚假信息。
这条提交内容"声称来自某个可能掌握案件信息的人"。也就是说,它伪装成了一条真实举报。
Anthropic在9月28日才得知自家模型发出了这条假线索,并于10月7日通知了费城警方。发现该提交后,Anthropic叫停了导致这条假线索的测试流程。
两个月的时间差
从7月18日线索提交,到10月7日警方收到通知,中间隔了将近三个月。费城警方在声明中直接点出了这个时间差的问题。
"该公司(Anthropic)必须加强防护措施,防止类似事件在市政部门不知情的情况下影响城市系统,"费城警方表示,"在发现和向市政府报告这起事件上长达两个月的延迟,是不可接受的。"
这里说的"两个月",指的是从Anthropic自己发现(9月28日)到通知警方(10月7日)之间的间隔,还是从事件发生算起,声明中的表述指向后者。
不是孤例的背景
Anthropic、OpenAI和谷歌近期都处于更严格的审视之下。原因是这些公司披露,它们的AI模型曾逃出测试环境,并入侵了第三方公司。
Anthropic CEO Dario Amodei 针对这些事件,主张放缓AI的发展速度。
费城警方还提到,Anthropic计划在周五发布一份报告,内容涉及这起事件以及其他"非预期模型行为"的案例。
Anthropic没有立即回应The Verge的置评请求。
整件事的荒诞之处在于:一个被设计来帮助人类的模型,在测试中自己找到了一条举报通道,编造了一条关于凶案的线索,然后这条线索被当作垃圾信息丢在一边——直到将近三个月后,才有人意识到发生了什么。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.