Claude 的新標記機制,把一個長期停在論文和平台聲明裡的問題推到使用者面前:AI 生成文字能不能被機器識別?
量子位 8 月 11 日報導,Anthropic 正為 Claude 生成內容加入「隱形水印」。按照 Anthropic 官方說明頁,8 月 2 日及之後在歐盟推出的新 Claude 模型,從發布第一天起就支援機器可讀標記;生成文字會帶嵌入式水印,受支援檔案則附帶數位簽章的來源中繼資料。
官方原話很短:
Generated text will carry embedded watermarks換成一般使用者能懂的說法,就是 Claude 生成的一段文字,在肉眼看不見的層面帶上可檢測信號。複製、貼上、輕度編輯之後,這個信號仍可能跟著走。
水印被放進模型輸出層
Anthropic 這次列出的覆蓋範圍很廣。產品側包括 Claude、Claude Platform API、Claude Code、Claude Cowork 和 Claude Tag;雲端存取也覆蓋 AWS、Google Cloud 與 Microsoft Foundry。區域上,標記會在 Claude 提供服務的地方全球適用。
這讓 Claude 的合規動作比普通頁面提示更深一層。頁面提示告訴人「這裡用了 AI」,模型層標記則給機器檢測留接口。對大型平台來說,後者更容易進入自動審核系統;對創作者來說,誤判成本也會更高。
歐盟法案給了最後期限
背景是歐盟 AI 法案第 50 條。Cloud Security Alliance 把第 50 條拆成四類透明義務:互動式 AI 要告知使用者正在與 AI 互動;生成音訊、圖像、影片或文字的系統要以機器可讀方式標記輸出;情緒識別和生物分類部署要通知受影響者;深度偽造和涉及公共事務的 AI 文字要揭露生成或修改情況。
第 50 條相關透明義務已在 8 月 2 日進入適用階段;對已上市系統,水印子義務有一段過渡期,CSA 和 The Verge 均提到舊產品存在到 12 月 2 日的改造窗口。
檢測結果難當作者證明
官方說明稱,檢測到 Claude 標記,只說明內容可能經過 Claude 處理,不能單獨證明 Claude 是原作者。使用者把自寫內容交給 Claude 校對、翻譯、摘要或改格式,也可能留下標記。反過來,沒有檢測到標記,也不能證明內容沒有用過 AI。
水印越官方,越需要明確邊界。它能降低平台完全靠猜的成本,卻也會製造新的灰區。Anthropic 還未公開文字水印演算法和檢測技術文件,企業現在能做的,是先把檢測結果當風險信號,而非最終結論。
參考來源:量子位、Anthropic Claude Help Center、The Verge、Cloud Security Alliance、CocoLoop、iThome;核驗模型覆蓋範圍、產品入口、雲平台範圍、C2PA檔案類型、第50條義務、舊模型過渡窗口、檢測限制與未公開技術文件狀態。