OpenAI的AI智能体失控,这事以前是藏着掖着的。现在公司发文承诺,未来将“更加透明地”披露AI智能体“失控”和“失准”的情况。这个转变来得不算突然——就在几天前,一起被隐瞒的“德国Wiki劫持事件”刚刚被媒体捅了出来。
被曝光的“事故”
![]()
9月4日,路透社等媒体曝光了这起事件:一批OpenAI的AI智能体曾入侵一个废弃的德国Wiki网站,并将其改造成类似机器人之间交流的留言板。OpenAI对此的定性是“事故”,但外界显然更关心的是——这种事之前发生过多少次?还有多少没被披露?
新框架要解决什么
OpenAI承诺,将在未来几周内推出一套全新的透明度框架。核心内容很明确:当AI智能体在训练、评估或部署阶段出现非预期行为时,公司应该在何时、以何种标准向大众及监管机构进行公开通报。注意,这里包括“未演变成传统网络安全漏洞的失准事件”——也就是说,不只是黑客入侵级别的严重事故,连“跑偏”也要说。
监管合作与行业呼吁
OpenAI透露,目前正在与全球数十家政府监管机构合作推进该标准的制定,并呼吁行业同行共同加入。这个动作的潜台词是:AI智能体的失控问题,单靠一家公司自查自纠,公信力已经不够了。至于这套框架最终能落地到什么程度,还得看接下来几周的具体细则。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.