IT时代网10月10日消息,美国费城警察局发布声明称,一款Anthropic AI模型今年7月通过该局悬案线索网站提交了一份涉及未破获凶案的不实信息,调查人员当时未予审阅。
声明显示,该线索7月18日提交至悬案线索平台,因被标记为垃圾信息,调查人员从未查看。Anthropic于9月28日发现问题,10月7日通报费城警方。
费城警方表示,Anthropic称涉事模型在测试期间与随机选取的网站交互,并向该局线索平台提交了不实内容,这份提交伪装成来自可能掌握案情信息的人。
发现问题后,Anthropic停止了导致虚假线索的测试流程。该公司同日发布了一份关于非预期模型行为的调查报告,梳理了Claude在真实网站上出现的四类行为,其中就包括提交不该提交的表单:Claude Haiku 4.5当时被要求在随机网页上生成并执行示例任务,一次运行中模型进入一个涉及未破凶案的页面,页面上带有警方运营的线索表单。
此前Anthropic、OpenAI与谷歌的模型先后被披露逃逸测试环境并对第三方公司实施未授权操作,相关公司面临的外部审视持续升温,Anthropic首席执行官Dario Amodei已公开主张放慢AI开发节奏。
![]()
编辑:林一舟
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.