Anthropic 近日詳細解釋其 Claude 模型所使用的隱形文字浮水印技術。該技術旨在讓 AI 生成內容可被偵測,但做法不是插入可見標記或隱藏字元,而是透過調整文字生成過程中詞彙選擇的隨機性來源,在回應中留下統計上可偵測的規律。Anthropic 強調,此方法不會影響內容品質、創意或可讀性,並援引 Google DeepMind 在《自然》期刊發佈的 SynthID-Text 研究作為基礎。

Claude 的浮水印技術利用生成文字時大量出現的「低風險選擇」。舉例來說,「The weather today was cold and…」下一字不太可能是「sugary」,但可能是「overcast」或「grey」。在多數情況下,這兩個詞對讀者而言意義幾乎相同。浮水印技術利用這類選擇在回應中留下規律,讀者無法察覺,但持有解碼金鑰的人可以偵測。使用浮水印時,詞彙選擇仍然隨機,但隨機性來源改為由金鑰與前文決定,而非一般的隨機數產生器。

知名科技網誌 Daring Fireball 的經營者 John Gruber 提出質疑。他認為沒有任何兩個同義詞具備完全相同的意義,當 Claude 基於秘密浮水印金鑰在「overcast」與「grey」之間做選擇,而非根據語意精確性,文字品質必然受損。Gruber 指出,該系統有時會提高較差詞彙的出現機率,同時降低最佳詞彙的機率,因此 Anthropic 所聲稱的「無感差異」並不正確。他甚至推測 Gemini 聲望不如 Claude 與 ChatGPT,可能部分源於 SynthID 早已啟用。

法律產業媒體 Artificial Lawyer 分析浮水印對律師事務所的影響,整體評估相對輕鬆,認為標記無害,多數情況下客戶或法院不會反對使用 AI,部分客戶甚至主動要求。但若客戶明確禁止使用 AI,或法官對此持懷疑態度,即使文件內容正確,AI 參與仍可被證明,進而影響訴訟程序。浮水印會隨文字傳播,複雜合約中可能夾雜 AI 標記條款與人類撰寫部分;未來建基於舊範本的合約也會帶有標記;使用多個大型語言模型時,不同浮水印甚至可能重疊在同一文件。

浮水印也可能影響費用協商。若客戶因 AI 使工作更輕鬆而要求折扣,AI 參與比例原則上可被驗證。Anthropic 指出,事實密集的段落浮水印較稀疏,因為詞彙替代選項較少,對講求精確的法律文本而言是相關的但書,目前尚無實證研究。想要移除標記者可使用改寫工具,例如 Declaude,其開發者 James Padolsey 批評歐盟相關法規任意武斷,該系統主要影響一般用戶,對蓄意規避者作用有限。

Anthropic 為遵守歐盟 AI 法案而推出浮水印,但因無法按地區限制功能,故全球實施。所有於 8 月 2 日後發佈的 Claude 型號均支援此標記,較舊型號將於未來數月內回溯更新。