2026年8月2日,欧盟《人工智能法案》第50条——关于AI透明度义务的核心条款——正式生效。该条款要求提供前沿AI模型的服务商必须确保模型生成的内容可被识别,否则将面临最高达1500万欧元(约合1.173亿人民币)或占企业全球年营业额3%的罚款。新规对8月2日之后发布的模型要求立即合规,而已上市的老产品则最晚需在12月2日前完成合规改造。

紧随法规生效,行业头部厂商Anthropic于8月11日宣布,其Claude系列所有在8月2日及之后发布的模型,生成的AI文本都将嵌入隐形水印作为标记。同时,Claude产出的图像大多会附带含数字签名的元数据,以表明文件出自AI之手。Anthropic声称,全球范围内的Claude输出都将带上文本水印,且此类标记“并不改变模型回复的含义、质量或可读性”,即便用户对文本做出某些改动,水印仍可能保留。

从技术原理看,Claude的文本水印通过算法微调大模型的选词逻辑,在模型输出文本时留下可统计识别的痕迹。但Anthropic也承认,水印本身难以揭示内容的完整“创作过程”——某段文本被检测出水印,只能作为提示“创作过程涉及AI”的信号,可能由Claude生成,却无法确证。例如,用户可能只是借助模型总结或转化了人类原创的想法。反之,检测不到水印也不代表文本非AI生成,因为水印基于选词模式的细微统计变化,若文本片段过短或经过改写、重述,水印可能消失。

水印对学术诚信的实际影响尚难定论。美国西北大学元科学研究员里斯·理查森(Reese Richardson)表示,鉴于去除AI文本水印的方法很简单——例如使用另一款AI产品重写文本——Anthropic的策略很难阻止有心之人利用AI炮制“AI垃圾”(AI slop),如虚假或低质的论文。

但也有同行持更积极的态度。卡内基梅隆大学计算机科学家尼哈尔·沙阿(Nihar Shah)从事科学评估研究,他认为如果AI企业对外开放水印检测工具,且工具误报率足够低,将能准确识别部分不当的AI使用行为。举例而言,水印可帮助期刊编辑、学术会议主办方严格落实“禁用AI”的同行评审规则。2026年7月的国际机器学习大会(ICML) 就将此规范用于其两套评审流程中的一套:分发给评审专家的论文稿件内嵌水印,一旦专家使用AI生成评审内容,文本便会携带可识别特征。最终,ICML发现506名专家违反禁用AI规定。主导这套水印流程的沙阿表示,此事说明虽有一部分违规使用AI者能刻意规避检测,但更多人会选择直接复制粘贴AI输出内容。

与此同时,有学者对将AI水印用作学术诚信评判依据表示担忧。曾从事分子生物学研究、如今经营写作编辑服务公司The Page Doctor的阿米娜·约尼斯(Amina Yonis)认为,不应单凭水印来质疑高校内的学术诚信。她担心人们会把AI水印当成非黑即白的判据——有水印即AI所写,无水印即人类原创,而那些意图隐瞒AI使用的学生往往也善于躲过水印检测。康奈尔大学物理学家、预印本平台arXiv创始人之一保罗·金斯帕格(Paul Ginsparg)则指出,很多合规论文本就借助AI完成,许多学者默认部分工作成果离不开AI辅助,最直观的案例来自AI在数学领域取得的累累硕果。他质疑添加水印对这类工作的实际意义,以及哪些研究者会费心思去清除水印。

Anthropic并非首家引入水印技术的AI企业。谷歌自2023年起就在其Gemini模型的浏览器端和App端输出文本中加入SynthID水印;OpenAI也已在图像、音频内容中采用SynthID技术。尽管AI企业可通过水印识别自家模型产出的文本,但迄今为止,尚无公司推出可供普通大众使用的文本检测工具——针对图像和音频内容,已有开放检测的厂商,包括OpenAI和谷歌。Anthropic发言人透露,公司正开发面向公众的文本检测工具。约尼斯则认为,如果用户发现只有Claude系列聊天机器人配套水印识别,其中部分人可能会换用其他公司的产品。