8月10日发布的一项预印本研究显示,公开共享的LLM API日志仍可能暴露隐藏在加密推理块中的客户数据——除非提供商同时撤销旧的加密信封。研究人员从公开的智能体轨迹中恢复了704个非基准测试工件,包括API密钥、口令、访问令牌和私钥。
论文描述的实时跨会话重放攻击在私下披露和提供商缓解措施后已无法复现,但论文的缓解附录指出,旧有的已发布信封要求撤销修复前的密钥并拒绝遗留信封。审核记录并未公开确认OpenAI、Anthropic或Google是否采取了这一追溯性步骤。
推理API通常在模型响应旁返回一个不透明块,并期望应用在下一个请求中包含它。这允许提供商在多轮对话中保留上下文,而无需在服务器端存储每次对话。这也意味着原始智能体日志可能包含发布者无法读取、搜索或可靠删除的数据。
“这些加密块在提供商的生态系统中跨会话、用户和模型完全兼容且可互换。”研究人员在预印本中写道。
该攻击利用这种可移植性作为解密路径:将加密推理块重放到同一提供商系列中的较弱模型,然后指示该模型转录其隐藏内容。研究人员报告称,在缓解措施之前,这一方法在Anthropic、OpenAI和Google上均有效。这与Claude提示注入数据外泄路径是不同的失败模式:在这里,敏感材料已经可以放在公共日志中,包装在看起来无害的API簿记中。
从真实公共会话中恢复的704个工件,由MATS Research和ELLIS Institute Tübingen的Alexander Panfilov、ELLIS Institute Tübingen的David Schmotz及其合著者共同解码。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.