21世纪经济报道记者肖潇 报道
现在网上随手一搜,能找到无数教程教人消除写稿“AI味”:少用破折号,删掉“不是……而是”,不要说“用一句最直白最不绕弯子的话解释”。但以后想隐藏AI代写的痕迹,会越来越难。
8月11日,Anthropic宣布启用AI标识制度:新一代Claude模型将默认把隐形水印直接编织进文本本身。这种水印无法被人眼看见,也不会直接改变文本内容,但会在复制粘贴时随文本一起保留,就算经过部分删改仍然可能留存。
可以理解为,Claude输出文字的同时会埋下一枚机器可读取的指纹。一条自媒体爆料、一篇考试作文、一篇期刊论文,即使离开Claude发布到不同平台,都可能被检测出AI来源。
听起来是一个小功能,但要做到并不容易。图片可以把水印藏进像素里,文件也可以套上数字签名,但聊天框里的纯文本?几乎没有可以隐藏水印的空间。这也是为什么AI文本的标识问题一直比图像标识更难解决。
Anthropic更新的时间点与欧盟直接相关。8月2日开始,欧盟《人工智能法案》针对通用AI模型的部分全面生效,其要求所有AI生成内容都可以被检测。除了Anthropic,谷歌、Meta、微软和OpenAI均已签署AI透明度行为准则,它们都需要在今年12月之前上线隐形水印。这也意味着,AI标识系统真正要在全球铺开了。
AI检测器已经流行几年了,但主动输出文字水印的大模型公司屈指可数。
2023年,美国普林斯顿大学学生开发的GPT Zero迅速走红,OpenAI也曾推出过自己的AI文本检测器。这类检测器的思路是在内容生成之后,再回头寻找文字规律,比如分析词汇概率、文本的困惑度和突发性,推测AI生成的可能性。
而事后检测和事前水印是两回事,后者要求模型主动留下一个只有机器能够识别的指纹。
给图像添加隐形指纹很容易,因为一张图片包含大量人眼无法察觉的像素,这一技术在纸钞上就已应用多年,但给纯文本添加水印要困难得多。“与图像不同,你几乎无法对一个句子进行任何人类无法察觉的修改,这是一个很有趣的工程难题。”GitHub的软件工程师Sean Goedeck曾撰文解释。
如何在一段看起来完全正常的文字里,隐藏一套只有机器知道的秘密规则?最简单的办法是人为制定一些规律,比如每生成五个字母必须包含一个“e”。但如果直接应用,会导致AI出现大量拼写错误,势必折损回答质量。
在此之前,OpenAI 和 Anthropic还尝试过统一字符码(Unicode),AI可能会将半角空格替换为三分之一全角空格,或者替换为全角空格——技术术语叫“同形异码字”。这确实是更隐蔽的水印,但依然很容易被识破,更禁不住粘贴、改写、翻译等常见操作。
在Claude官宣文字水印之前,唯一一家声称有文字水印的AI公司是谷歌,其使用的是一款名为SynthID的工具。
SynthID的思路,是利用大模型的数学概率分布来隐藏信息。大模型每生成一个词语,都会给下一个预测词分配概率。谷歌在这个过程中引入一套只有自己知道的采样规则,例如在概率最高的一组候选词中,优先选择SynthID评分更高的词。
当足够长的一段文字累积下来,这些选择便会形成一种数学规律。人类读起来无法察觉异常,但机器可以计算规律得分,如果总分异常高,说明大概率是AI生成的。
Sean Goedeck认为,除了SynthID,目前几乎没有其他水印可以同时做到成本低、不影响AI回答质量、还不容易被删除。本次Anthropic没有披露技术细节,因此不清楚思路是否和SynthID类似。
按照欧盟《人工智能法案》的相关要求,AI公司不仅需要提供隐形水印,还需要提供能够检测水印的工具。Anthropic在博客中表示,下一步将向用户和第三方平台开放检测器,并公布具体的检测流程。
AI代写让学术作弊和虚假新闻的争论越来越多。学生可能偷偷使用AI写考试论文,学术期刊通常要求作者披露AI创作,但由于AI文本无法被证实或证伪,自我披露的动力是很弱的。
正因如此,AI检测工具很受欢迎。知网、格子达、Turnitin等论文平台都推出了AIGC检测功能,用来识别AI生成内容。2024年开始,国内许多高校要求毕业论文必须通过这些工具的AI率检测。
但真正用起来会发现,检测的最大难题是准确率。
我们曾在2024年报道发现,尽管许多AI检测工具声称误判率在1%之内,但在使用过程中,误判概率远高于官方数字。最大的误判重灾区是语法工具、翻译软件,以及一些鲜明的个人风格,连鲁迅的文章都被检测出“AI疑似度高”。(《高校检测AI论文背后》)
Anthropic这次也特别强调了这一点:检测到的水印只是信号,不是证据,无法证明Claude参与程度有多深。比如一名学生自己写完了论文,只是让Claude简单润色,可能留下AI水印;反过来,一篇由Claude直接起草的文章,如果经过大量人工修改,也可能让AI水印消失。
换句话说,AI水印无法直接解决内容真实性与写作诚信问题,只能当作一个来源参考。但这件事的重要性在于,分辨来源原先是用户的事,现在变成AI公司需要承担的基础设施责任。
Anthropic表示,标识系统的上线来自欧盟要求。按照欧盟《人工智能法案》的要求,最迟今年12月之前,Anthropic、谷歌、Meta、微软、OpenAI等通用型大模型都需要增加AI水印机制,确保AI输出的所有内容,同时具有数字签名的元数据和隐形水印,并能让第三方相互检测。
如果未落实AI标识要求,欧盟委员会的罚款最高可达1500万欧元,或者上一财年全球总营业额的3%。
在欧盟之前,国内早在2025年9月就开始实行《人工智能生成合成内容标识办法》,要求文本、图片、音频、视频、虚拟场景等AI合成内容需打标,并设置了显式、隐式两类标识。
目前国内更常见的是显式标识,比如在AI聊天页面提示“内容由AI生成”,隐式标识则主要依赖文件元数据。对于聊天框里的纯文本而言,如何添加标记并确保其不被轻易移除,同时还能被其他平台识别,仍然是一个需要解决的问题。
美国目前则没有全国性的AI标识强制规则,但在AI公司云集的加州,《人工智能透明度法案》已于今年1月1日正式生效,同样要求在文件数据中嵌入隐式标识,显式标识则由用户自由选择。
AI标识已是全球共识,只是技术要求和覆盖范围不同,欧盟无疑是最严一档。Anthropic表示,标识机制上线后将覆盖全球Claude用户,而不限于欧盟市场。
对于这些全球化大公司,一旦采用统一的产品策略,欧洲的监管要求就会随着产品一起输出到全球。接下来要关注的便是其他几家AI巨头如何“交付”自己的合规方案,以及欧盟这套监管规则,会不会再次变成一套全球标准。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.