OpenAI要给ChatGPT的文本加水印了。不是为了防抄袭,是为了合规——欧盟AI法要求AI生成内容必须能被识别出来。这家公司宣布,将在未来几周内,面向欧盟用户推出文本水印功能,覆盖ChatGPT和Codex的所有付费计划。
但真正值得看的,是OpenAI自己公布的一组检测数据:未经编辑的AI文本,检测器识别率是92%;把文中10%的词换成同义词,识别率掉到66%;换掉25%,只剩17%。
![]()
水印怎么藏进文字里
![]()
这套水印不靠元数据,也不靠隐藏字符。它的做法是:在AI模型选词的时候,微妙地改变选择倾向,让生成的文本里留下一种人眼看不出的模式。检测器拿到文本后,通过识别这个模式来判断是不是AI写的。
因为水印嵌在单词本身,复制粘贴不会让它失效。OpenAI同时强调,水印不会让用户被识别出来,开启后模型的性能也不会有明显变化。
和这项功能一起发布的,还有一份关于检测技术「textGrain」的报告。不过OpenAI自己承认,水印不是万能的。
短文本、数学题、翻译,都是盲区
除了同义词替换会大幅拉低检测率,OpenAI还列出了几个检测困难的场景:短句子、数学答案、翻译后的文本。这些情况下,水印的识别效果都不理想。
![]()
正因如此,初期阶段检测器的访问权限被限制得很死——只有经过批准的研究人员和专业机构才能用。
OpenAI还专门发了一句提醒:没有水印,不能证明就是人写的。反过来,有水印只能说明AI参与了生成,但「无法判断其中投入了多少人类的判断、编辑和创造力」。
API开发者可以开,但默认是关的
对于全球使用OpenAI API的开发者,部分AI模型支持主动开启这项水印功能。但默认状态下它是关闭的。OpenAI表示,目前没有计划在全球范围内默认启用文本水印。
欧盟的AI法对AI生成内容提出了「可识别为人工生成」的标注要求。OpenAI这次的动作,是围绕这条规则做的合规部署。水印功能只针对欧盟圈内的用户,其他地区暂时不在覆盖范围内。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.