2026年8月2日,歐盟《人工智慧法案》第50條——關於AI透明度義務的核心條款——正式生效。該條款要求提供前沿AI模型的服務商必須確保模型生成的內容可被識別,否則將面臨最高達1500萬歐元(約合1.173億人民幣)或佔企業全球年營業額3%的罰款。新規對8月2日之後釋出的模型要求立即合規,而已上市的老產品則最晚需在12月2日前完成合規改造。

緊隨法規生效,行業頭部廠商Anthropic於8月11日宣佈,其Claude系列所有在8月2日及之後釋出的模型,生成的AI文本都將嵌入隱形水印作為標記。同時,Claude產出的影像大多會附帶含數字簽名的後設資料,以表明檔案出自AI之手。Anthropic聲稱,全球範圍內的Claude輸出都將帶上文本水印,且此類標記“並不改變模型回覆的含義、質量或可讀性”,即便使用者對文本做出某些改動,水印仍可能保留。

從技術原理看,Claude的文本水印通過演算法微調大模型的選詞邏輯,在模型輸出文本時留下可統計識別的痕跡。但Anthropic也承認,水印本身難以揭示內容的完整“創作過程”——某段文本被檢測出水印,只能作為提示“創作過程涉及AI”的訊號,可能由Claude生成,卻無法確證。例如,使用者可能只是藉助模型總結或轉化了人類原創的想法。反之,檢測不到水印也不代表文本非AI生成,因為水印基於選詞模式的細微統計變化,若文本片段過短或經過改寫、重述,水印可能消失。

水印對學術誠信的實際影響尚難定論。美國西北大學元科學研究員里斯·理查森(Reese Richardson)表示,鑑於去除AI文本水印的方法很簡單——例如使用另一款AI產品重寫文本——Anthropic的策略很難阻止有心之人利用AI炮製“AI垃圾”(AI slop),如虛假或低質的論文。

但也有同行持更積極的態度。卡內基梅隆大學電腦科學家尼哈爾·沙阿(Nihar Shah)從事科學評估研究,他認為如果AI企業對外開放水印檢測工具,且工具誤報率足夠低,將能準確識別部分不當的AI使用行為。舉例而言,水印可幫助期刊編輯、學術會議主辦方嚴格落實“停用AI”的同行評審規則。2026年7月的國際機器學習大會(ICML) 就將此規範用於其兩套評審流程中的一套:分發給評審專家的論文稿件內嵌水印,一旦專家使用AI生成評審內容,文本便會攜帶可識別特徵。最終,ICML發現506名專家違反停用AI規定。主導這套水印流程的沙阿表示,此事說明雖有一部分違規使用AI者能刻意規避檢測,但更多人會選擇直接複製貼上AI輸出內容。

與此同時,有學者對將AI水印用作學術誠信評判依據表示擔憂。曾從事分子生物學研究、如今經營寫作編輯服務公司The Page Doctor的阿米娜·約尼斯(Amina Yonis)認為,不應單憑水印來質疑高校內的學術誠信。她擔心人們會把AI水印當成非黑即白的判據——有水印即AI所寫,無水印即人類原創,而那些意圖隱瞞AI使用的學生往往也善於躲過水印檢測。康奈爾大學物理學家、預印本平台arXiv創始人之一保羅·金斯帕格(Paul Ginsparg)則指出,很多合規論文本就藉助AI完成,許多學者預設部分工作成果離不開AI輔助,最直觀的案例來自AI在數學領域取得的累累碩果。他質疑新增水印對這類工作的實際意義,以及哪些研究者會費心思去清除水印。

Anthropic並非首家引入水印技術的AI企業。谷歌自2023年起就在其Gemini模型的瀏覽器端和App端輸出文本中加入SynthID水印;OpenAI也已在影像、音訊內容中採用SynthID技術。儘管AI企業可通過水印識別自家模型產出的文本,但迄今為止,尚無公司推出可供普通大眾使用的文本檢測工具——針對影像和音訊內容,已有開放檢測的廠商,包括OpenAI和谷歌。Anthropic發言人透露,公司正開發面向公眾的文本檢測工具。約尼斯則認為,如果使用者發現只有Claude系列聊天機器人配套水印識別,其中部分人可能會換用其他公司的產品。