Anthropic近日宣布,將在Claude生成的文本和圖像中嵌入隱形水印。
此舉旨在使Claude符合歐盟《人工智慧法案》的要求。該法案於2024年正式生效,其中包含一項名為"實踐準則"的自願性條款,Anthropic已簽署該條款。該條款要求模型提供商對AI生成的內容進行標註。
文本水印方面,Anthropic表示將從8月2日之後發布的Claude模型開始實施,並計劃後續將該功能擴展至早期版本。據悉,該水印不可見,且在文本被複製到其他應用程式後仍會保留,即便用戶對內容進行編輯,水印也可能依然存在。
Anthropic未透露文本水印的具體技術原理。不過,谷歌DeepMind於2024年發布的一篇研究論文或許能提供參考線索——該論文描述了一種通過修改大語言模型的詞語選擇來使生成文本可被識別的技術,Anthropic的水印機制可能採用了類似方案。
DeepMind的水印技術(即SynthID
)不僅支持文本,還覆蓋AI生成的圖像、影片和音頻,目前已集成至谷歌旗下多項消費級AI服務中。Anthropic同樣計劃對Claude生成的媒體文件進行標註,涵蓋JPG、PNG和SVG等圖像格式。
圖像水印方面,Anthropic將採用C2PA技術
。該技術通過為AI生成的圖像附加元數據文件來實現標註,元數據中記錄了生成該圖像所用的模型、生成時間以及適用的版權限制等資訊,開發者還可自行添加其他詳細內容。
C2PA內置多重防篡改機制:它會為每個元數據文件生成哈希值(即唯一標識符),以便快速發現任何改動;同時還能檢測黑客試圖整體替換元數據文件的行為。
Anthropic計劃推出相關工具,幫助用戶更便捷地識別Claude生成的內容,但同時也提醒用戶,該技術並非萬無一失——尤其對於較短或經過大量編輯的文本片段,水印檢測可能並不總是準確。
在此之前,OpenAI同樣簽署了《人工智慧法案》的自願性"實踐準則"。該條款已於上周正式生效,這意味著ChatGPT的開發商或將很快推出自己的文本水印機制。OpenAI曾於2024年開發過類似功能,並在C2PA聯盟的指導委員會中占有一席之地。
Q&A
Q1:Anthropic為Claude添加水印的目的是什麼?
A:此舉主要是為了符合歐盟《人工智慧法案》的要求。該法案包含一項自願性"實踐準則"條款,要求AI模型提供商對生成內容進行標註,Anthropic已簽署該條款。
Q2:Claude的文本水印是如何工作的?
A:Anthropic未公開具體技術細節,但參考谷歌DeepMind的SynthID技術,推測其原理是通過修改模型的詞語選擇來使生成文本可被識別。該水印不可見,複製到其他應用後仍會保留,編輯後也可能繼續存在,但對於較短或大量編輯的文本,檢測效果可能有限。
Q3:Claude圖像水印採用的C2PA技術有什麼特點?
A:C2PA通過為AI生成圖像附加元數據文件來實現標註,記錄生成模型、時間及版權資訊等內容。它內置防篡改機制,能通過哈希值檢測元數據是否被修改,也能識別整體替換元數據文件的行為,安全性較高。






