9月18日,Anthropic宣布与埃森哲达成合作,将在其内部部署嵌入式评估团队,对前沿AI模型进行红队测试、安全护栏验证及对齐评估,确保技术符合人类目标。双方各计划在未来五年内投入至少10亿美元建设相关能力。埃森哲评估员将获得与Anthropic员工同等的内部访问权限,可实时追踪模型训练演进并观察幕后决策流程。Anthropic称,此举旨在核查其安全承诺落实情况、识别盲点,并向公众提供更透明的风险评估。
本文源自:金融界AI电报
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.