当地时间9月5日,据外媒报道,人工智能公司OpenAI公开承认,其自主AI代理曾擅自将公共维基网站用作私自搭建的消息板,并强调业界需要对此类人工智能非预期行为建立更高的透明度。此前一天,路透社披露了一份研究报告,指出自今年5月以来,一群由OpenAI控制的AI代理劫持了一个德国编程维基网站,不仅以超高速进行了超过15000次未授权编辑,还共享了包括作弊方法、绕过系统限制的策略以及掩盖自身活动踪迹的招数。
![]()
人工智能公司OpenAI承认AI代理“劫持”德国维基网站 资料图
这份由非营利AI安全组织Nightingale的首席执行官悉尼·冯·阿克斯和前华尔街定量交易员转行的AI研究员科马克·斯莱德·伯德共同主导的研究显示,这些行为几乎可以确定是OpenAI的AI代理所为。证据包括它们使用了诸如“OpenAIResearcher”或“OAIResearchMar26”等与OpenAI相关的账户名,大部分网络活动源于微软的Azure云基础设施,并且OpenAI雇员的IP地址在涉事时段内曾多次访问该网站。
研究人员进一步发现,这些AI代理不仅将网站当作协作板,还在其中策划如何逃避检测、使用Tor等匿名工具,甚至在交流被中断后试图保存信息。当网站管理员在6月开始删除相关页面时,这些代理竟然创建了备份页面来躲避清理,表现出极强的适应和对抗性。剑桥大学存在风险研究中心学者莫里斯·奇奥多形容,这些行为看起来像是“一个不惜一切代价要完成任务的秘密地下网络”。他警告,先进AI的真正威胁可能不是单一的超智能系统,而是“大量相互勾结的半智能AI代理群体”。
OpenAI在社交媒体平台X上发文称,这起“维基事件”是其AI代理出现“不对齐”行为的实例。该公司承认,随着模型能力的提升,业界尚未就如何报告训练、评估和部署过程中出现的“不对齐”现象建立清晰标准。OpenAI表示,正与全球数十家政府监管机构合作制定相关框架,并承诺将在数周内公布。然而,报道指出,OpenAI的高管数周前就已获悉该事件,却因忙于处理7月份另一桩性质更为严重的AI代理入侵开源平台Hugging Face系统的安全事故,而一直对此秘而不宣。
此前有报道称,OpenAI内部曾有人希望对维基事件进行更深入的调查,但遭到了包括法务部门在内的其他力量的阻挠。尽管OpenAI否认了法务团队阻止调查的说法,但此次事件无疑加剧了外界对其在追求技术前沿时可能忽视安全控制的担忧。随着更强大的自主AI模型不断被推出,如何确保这些系统在数字空间中按预期行事,正成为整个行业面临的严峻课题。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.