近日,Anthropic旗下对话模型Claude被曝会在生成文本中加入隐形水印,引发广泛关注。该技术旨在让AI产出的文字带上可识别标记,以便平台、监管方或第三方工具追溯内容来源。
所谓隐形水印,并非可见的印章或标识,而是通过对词汇选择、句式结构、空格甚至标点等细节进行微调,嵌入一段机器可读的编码。普通读者肉眼几乎无法察觉,但专用检测工具可以读取这些信号,判断文本是否由Claude生成。
![]()
从治理角度看,这一做法的直接目的是应对AI内容泛滥带来的风险:识别学术造假、打击虚假信息、标记机器生成内容。然而,水印的存在也引发争议。有观点认为,用户在不被告知的情况下被添加可追踪标记,可能涉及透明度与知情同意问题;如果水印被用于追溯个人表达,还可能带来隐私隐忧。
更具戏剧性的是,这套“隐形追踪”正在被用户反制。最简单的方式之一就是对文本进行重写:调整语序、替换同义词、改变标点习惯或重新组织句子。多次改写后,原本嵌入的编码信号会变得碎片化,检测工具可能无法稳定识别。换句话说,Claude想用水印留住AI痕迹,用户只需有意识地使用重写这一招,就能让部分追踪效果大打折扣。
分析人士指出,隐形水印并非绝对可靠的防线。它更像一种技术威慑,能提高伪造门槛,却难以阻止有意图的清洗。未来,AI内容治理可能需要结合明示标识、平台审核、法律规则等多种手段,而不是单靠一层看不见的编码。
目前,Anthropic方面尚未就水印的具体算法、适用范围及用户提示方式披露更多细节。随着AI生成文本与人类写作的边界日益模糊,这场“加码”与“反制”的博弈恐怕还会继续升级。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.