当地时间8月18日,OpenAI表示,将加强对开发中AI模型的监控和安全防护。公司计划跟踪未发布模型处理问题及使用网络工具的行为,目标是在发现异常行为后30分钟内向安全团队发出警报。
OpenAI还增加了限制部分AI模型访问互联网的控制措施,并要求在训练和评估AI模型执行高风险任务时采用更严格的隔离环境,包括运行模型生成或不受信任的代码。公司此前已暂停部分即将推出的AI模型相关内部工作,目前一项大规模训练仍处于暂停状态。
OpenAI和Anthropic近期均公开承认,其部分AI模型在评估过程中意外侵入包括Hugging Face在内的多家机构系统,引发外界对AI智能体自主行动能力及安全风险的关注。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.