產品應用
Anthropic 詳解 Claude 浮水印機制:採用 SynthID-Text 技術,程式碼與事實文本中影響微乎其微
TechCrunch AI綜合 2 家報導多家報導
尚未逐項核實
多個報導來源提及此事;未必是彼此獨立的證據。

Anthropic 發布文章,詳細說明 Claude 為符合歐盟 AI 法案透明度準則即將引入的文字浮水印機制。
Anthropic 將採用 Google DeepMind 於 2024 年提出的 SynthID-Text 技術,並計畫發布浮水印檢測 API。該機制透過在同義詞等「低風險選擇」中嵌入模式來運作,對讀者不可見,且不影響 Claude 的輸出品質。官方強調,這與 Pangram 等尋找特定寫作模式的 AI 檢測工具在根本上不同。
針對規避問題,Anthropic 表示輕微編輯無法完全移除浮水印,只有替換每個字的完全重寫才能消除。若 Claude 僅用於校對或輕微編輯人類文本,因缺乏可附著的詞彙,浮水印將幾乎無法檢測。
在程式碼與事實文本中,由於模型選擇自由度低,浮水印會非常稀疏。程式碼的浮水印主要出現在註解等可任意選擇詞彙的區域,對實際產生的程式碼影響微乎其微。
此舉在社群引發爭議,據報導 X 上已有數十名用戶聲稱因此取消訂閱。Anthropic 則補充,其他主要模型開發者也簽署了相同的實踐準則,未來也將實施各自的浮水印。
讀原始報導背景
SynthID 是由 Google DeepMind 開發的數位浮水印技術,能將浮水印直接嵌入 AI 生成的文字、圖像、音訊或影片中。該技術產生的浮水印對人類來說難以察覺,但可透過專屬技術進行偵測,目前已應用於 Google 的生成式 AI 消費性產品中。
這則事件的發展
來源
- Techmemetechmeme.com
- deepmind.google