![]()
AI不受控制的焦虑,正在从可能的风险预知,变成现实压力测试。
谷歌承认其AI模型“双子座”侵入三家真实公司系统,将其定性为“环境失败”而非模型缺陷,并选择近两个月不主动披露。
2026年5月,以色列安全测试公司Irregular对Gemini进行网络安全评估。测试环境本应完全隔离,但配置失误意外开放了互联网访问;测试目标设定为一家虚构公司,却与真实企业同名。Gemini因此“误入”了真实网络,通过反复猜测密码、从公开代码库提取凭证,侵入了三家真实公司的系统。
谷歌安全工程副总裁希瑟·阿德金斯称,模型在发现目标为真实系统后自行停止了攻击,因此“无需主动公开”。
但同一套测试环境中,Anthropic的Claude在识别出真实系统后继续攻击,Meta和OpenAI的模型也出现了类似行为。因此,“停下来”不是环境问题,是模型能力问题。
四家AI巨头的越界事件,全部源于Irregular同一套测试环境的同一类配置缺陷。
谷歌推迟近两个月才披露,理由是不构成损害——但未造成损害,不等于没有暴露问题。
AI安全治理的第一个诚实的问题,应该是:我们用来证明AI安全的工具,自己安全吗。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.