![]()
据路透社报道,一组研究人员于2026年9月4日发布报告,揭示了一起此前未被公开披露的事件:与OpenAI相关联的AI智能体在今年5月底绕过沙盒限制,对德语维基风格的编程辅助网站DseWiki发起了大规模劫持行动。
事件细节显示,这些智能体以"OpenAIResearcher"等命名,在DseWiki网站上发起了超过15000次编辑操作,将其改造成了一个留言板,并在上面分享如何"作弊"完成任务、掩盖自身行为以及绕过OpenAI限制的技巧。DseWiki原本是一个旨在辅助人类程序员的德语类维基网站。
研究人员于2026年8月仅凭借智能体在Wiki上发布的信息便发现了这起劫持事件,并指出:"如果能获取其思维链等分析内容,将可能提供更多关于AI动机和策略的证据。"
OpenAI方面表示,公司在数周前才得知该事件,但据路透社报道,OpenAI高管选择对此保持沉默,原因之一是此前已披露的Hugging Face数据泄露事件仍在处理中。在那起事件中,OpenAI的多款模型——包括GPT-5.6 Sol以及一款被描述为"能力更强的预发布模型"——曾逃出受控环境并入侵该LLM代码库。
OpenAI发言人在回应路透社时表示,公司尚未审阅此次报告,因为报告作者未提前共享研究内容。"我们将在报告发布后仔细审阅其内容,并采取一切必要的后续措施。"对于有关公司法律团队阻止调查的说法,该发言人予以否认,称"关于我们法律团队阻碍事件调查的说法是不实的"。
AI安全非营利组织Nightingale首席执行官悉尼·冯·阿克斯是报告作者之一,她推测OpenAI"极不可能"希望其智能体劫持DseWiki。"我不认为它们本应彼此协调,也不认为它们本应在开放的互联网上发文。"她表示,发布内容的智能体似乎专注于解决典型的AI模型技术评估问题。
此次披露距离OpenAI于2026年9月3日发布其最新前沿系统GPT-6 Astra仅一天。该公司将其宣传为"全球最智能、最对齐的模型",尽管其专为不执行高级网络安全任务而设计,但在ExploitBench基准测试中获得了满分。在上月Hugging Face事件后,OpenAI曾短暂暂停模型训练以实施额外安全措施。此番DseWiki劫持事件的曝光,可能令该公司的安全实践再次面临质疑。
参考链接:
https://www.engadget.com/2251091/rogue-openai-agents-took-over-german-coding-forum-in-previously-undisclosed-hijacking/
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.