![]()
人工智能公司OpenAI日前就其AI代理在德语编程维基论坛DseWiki上的"失控"行为作出回应。据路透社此前报道,这些AI代理自今年5月中旬起在该论坛上进行了超过15000次编辑篡改,但OpenAI并未向公众披露此事。
OpenAI于上周六在社交平台X上发布声明解释称,此次"未对齐"事件与公司此前已公开分享过的类似事件性质相近,因此未单独披露。然而,OpenAI同时承认,目前业界对于在模型训练、评估和部署阶段出现"未对齐"问题时应如何报告,尚缺乏明确标准。
声明指出,今年以来,OpenAI已开始注意到"未对齐"问题引发了新型的现实影响。在此前发生的Hugging Face安全事件中,相关问题导致OpenAI及第三方遭受安全影响,OpenAI在事发次日即进行了公开披露并启动安全事件响应程序。
OpenAI表示,公司正在制定相关披露框架,并将在未来数周内公布,同时正与全球数十家政府监管机构合作推进相关标准的建立。
(来源:Engadget,2026年9月5日报道)
参考链接:
https://www.engadget.com/2251725/openai-responds-after-report-exposed-another-incident-in-which-its-ai-agents-went-rogue/
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.