Anthropic已开始为未来Claude模型生成的文本加入水印,该公司称这一调整旨在帮助识别某段文字是否很可能由自家AI生成。这项为遵守欧盟规则而引入的新功能,肉眼无法察觉,也不会改变Claude的正常输出。 从原理看,水印利用了大语言模型在生成文本时大量低风险、小规模的选词决策。与水印版本不同,系统不再使用完全任意的随机数来做选择,而是结合加密密钥与上文内容来决定。Anthropic称,这会在一段回复中留下细微的统计模式,人眼不可见,但持有对应密钥的人可据此估计该文本由Claude生成的概率。 在成本与质量方面,Anthropic明确表示水印不会影响输出质量。内部测试显示,加水印与不加水印的回复在创造力、准确性和可读性上没有可测量的差异,相关方法也参考了Google DeepMind对底层技术的研究。在真实流量中测试类似水印时,用户满意度未出现统计上的显著变化。同时,水印不增加额外token,因此不会拖慢Claude或提高使用成本。 该水印也有局限。Anthropic解释,它只在模型面临多个同样有效的选项时才能发挥作用;如果文本生成过程中缺少足够的选择空间,水印可能难以形成可检测的统计模式。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.