Claude水印|生成圖文嵌入隱形水印 遵從歐盟AI新法案 Anthropic推識別措施
原文刊於信報財經新聞「CEO AI⎹ EJ Tech」
以往利用人工智能(AI)代筆,或許難以辨認,日後卻可能變得「證據確鑿」,一舉一動無所遁形。為遵守歐盟AI透明度的規定,美國AI初創Anthropic開始在Claude輸出的文字及圖片上,添加數碼簽章的來源元資料(Metadata)。生成的內容將帶有嵌入式水印,這些隱藏圖案用肉眼無法察覺,但機器可以檢測得到,複製貼上仍然有效,方便用戶及網上平台,識別內容是否由Claude模型生成。
網民憂用AI輔助也遭標籤
新標記政策宣布後,隨即在社交媒體上引發熱議,有網民認為這是「開創極為惡劣先例」,部分人擔心將來使用Claude協助改寫、潤飾或翻譯個人原創文章時,產出內容也會帶有水印,恐導致誤判。
歐盟2024年通過的《人工智能法案》,被視為全球首項全面的AI規範法律。於8月2日生效的第50條規定,新增AI標籤及透明度的義務。不遵守規定的科企可處以最高1500萬歐羅(約1.35億港元),或全球年度總營業額3%的罰款,以較高者為準。為了讓用戶知悉資料性質,企業應在AI生成的內容,以水印等方式清楚標示。
截圖轉換格式或令標記消失
Anthropic新標記政策全球通用,不只限於歐洲,涵蓋Claude所有服務,包括Claude應用程式、應用程式(API)介面平台、Claude Code、Claude Cowork及Claude Tag,以及透過亞馬遜網絡服務(AWS)、Google Cloud,以及Microsoft Foundry存取的Claude模型。
Claude使用兩種互補技術,標記AI模型生成及處理的內容。首先是嵌入文本的水印,經過編輯後仍可能存在;對於PNG、JPG、SVG等圖像文件,Anthropic使用「內容溯源和真實性聯盟」(C2PA)開放標準。
Anthropic明確表示,水印僅屬訊號而非證據,只能證明文本可能經過Claude編輯,無法證明文本如何產生。普通的校對、翻譯或重新排版,一般不會移除標記,但格式轉換、重新儲存、熒幕截圖等方式可能令元資料消失。大規模的編輯、翻譯,或者使用短段落、舊模型,亦可能導致Claude作品不被發現。
AI寫作包含結構、風格及語義模式,可以被訓練有素的人士,或先進的檢測軟件識別出來。美企Pangram Labs今年7月,推出AI文字偵測模型Pangram 4,其誤報率僅為0.0041%,即每2.4萬份文件僅一個誤報,聲稱檢測準確率99.98%。
不過,坊間各界亦費盡心機,破解AI系統的檢測。以水印去除器為例,聲稱可以免費去除Claude、ChatGPT、Gemini等AI系統的水印,消除隱藏的零寬度字元、不可見空格,以及其他Unicode標記。
OpenAI開發識別技術進展慢
目前為止,Anthropic尚未推出官方偵測工具,但已表示會努力使用戶和第三方能夠偵測水印,又預告日後的技術文件,將會詳細介紹檢測機制。學校、僱主及內容平台,日後可能將偵測結果,視為AI代筆的證據。計劃在社交平台X及Reddit遭到強烈反對,有人認為是「開創極為惡劣先例」,也有用戶宣布「AI寫作無法被證實的時代」結束。
Anthropic並非孤軍奮戰,例如谷歌DeepMind已開發出SynthID,用於標記AI生成的文字、影像及音訊;OpenAI也討論過水印技術,但其部署進展較緩慢。網上訂閱平台Substack推出AI掃描器,讓讀者估算文章及評論中,人工撰寫及AI生成內容的比例。短片分享平台YouTube也採取相應措施,上月更新其「不真實內容」政策,旨在打擊平台上泛濫的AI垃圾內容。
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。



















