Claudeは、AI生成テキストを機械が読める形で識別できるのかという長年の論点を、実際の製品問題に変えた。
量子位は8月11日、AnthropicがClaude生成コンテンツに見えないマークを追加していると報じた。Anthropicのヘルプページによると、8月2日以降にEUで提供される新しいClaudeモデルは、公開初日から機械可読の表示に対応する。生成テキストには埋め込み透かしが入り、対応ファイルには署名付きの来歴メタデータが付く。
公式の表現は短い。
Generated text will carry embedded watermarks利用者の言葉に置き換えると、Claudeの出力には、コピー、貼り付け、軽い編集の後も残る可能性がある信号が入る。
透かしはモデル出力層に入る
対象は広い。Claude、Claude Platform API、Claude Code、Claude Cowork、Claude Tagに加え、AWS、Google Cloud、Microsoft Foundryからの利用も含まれる。地域面では、Claudeが提供される地域でグローバルに適用される。
Claudeの合規対応は、通常の画面上の注意書きより一段深い。画面の表示は人に「AIを使った」と伝える。モデル層の信号は、機械検出の入口を作る。大規模プラットフォームにとっては自動審査に組み込みやすいが、制作者側では誤検知のコストも高くなる。
EU法が期限を作った
背景にあるのはEU AI Act第50条だ。Cloud Security Allianceは第50条の透明性義務を、AIとの対話通知、生成コンテンツの機械可読表示、感情認識・生体分類の通知、ディープフェイクや公共事項に関するAIテキストの開示に分けて整理している。
CSAとThe Vergeはいずれも、旧製品には12月2日までの対応猶予があると説明している。Anthropicは、8月2日以降にEUで出す新モデルには最初から表示機能を載せ、旧モデルにも対応を追加する形を選んだ。
検出は作者証明にならない
Claudeのマークが検出されても、それは内容がClaudeで処理された可能性を示すだけで、Claudeが原作者だと単独で証明するものではない。自分で書いた文をClaudeで校正、翻訳、要約、整形した場合にも信号が残り得る。逆に、マークが見つからないことはAI未使用の証明ではない。
公式の透かしほど、境界線の説明が必要になる。完全な推測に頼るコストは下がるが、新しいグレーゾーンも生まれる。Anthropicはテキスト透かしのアルゴリズムや検出技術文書をまだ公開していない。企業が今できるのは、検出結果を最終判定ではなくリスク信号として扱うことだ。
参考情報:量子位、Anthropic Claude Help Center、The Verge、Cloud Security Alliance、CocoLoop、iThome;モデル対象範囲、製品入口、クラウド範囲、C2PAファイル形式、第50条義務、旧モデル移行期間、検出限界、未公開の技術文書状況を確認。