Anthropicは最近、一部の新しいClaudeモデルが生成する文章やファイルに、機械可読の「不可視の電子透かし」を加え始めた。画像の透かしのように画面へ表示されるものではなく、対応するシステムがClaudeによる生成や処理の痕跡を識別できるようにする仕組みだ。

Claude 文字中的機器可讀標記概念插圖
Claudeの文章に含まれる機械可読の不可視マークを表現した編集部オリジナルイラスト。

何が変わったのか

今回の変更は、8月2日以降にEUで提供された新モデルが中心だ。Anthropicによれば、関連するマークはClaudeが提供される地域で広く使われるため、EUの利用者だけを対象にした仕組みではない。文章とファイルでは異なる形式の機械可読マークが使われる。

背景にはEU AI法第50条の透明性要件がある。AIが生成または大きく加工したコンテンツを識別できるようにする考え方だ。Anthropicは「AIを使った」と利用者が自己申告するだけでなく、出力そのものに技術的な信号を持たせようとしている。

万能なAI検出器ではない

このマークだけで「文章全体がAIによって書かれた」と判断できるわけではない。人が下書きした文章をClaudeに校正、翻訳、整形させても印が付く可能性がある。一方で、大幅な書き換えや人間の文章との混在、短すぎる文章では識別しにくくなることもある。

つまり、機械がマークを検出しても、それだけで盗用、カンニング、著者の身元を証明することにはならない。

利用者にとって重要なこと

学生、企業、コンテンツチームは「AIを使った」ことと「AIがすべてを書いた」ことを分けて扱う必要がある。バージョン履歴、人によるレビュー、資料の出所、著者の説明は、単一の検出結果よりも制作過程を説明しやすい。

Anthropicにとっては、透明性の規則を製品の出力へ組み込む第一歩だ。利用者にとっては、普段の校正や翻訳でも、人間には見えにくいがシステムには読める痕跡が文書に残る可能性を意味する。

まずは信号として扱う

Claudeの不可視マークは注目すべき変化だが、正しく理解するなら「出所と処理の流れを示す信号」であって「著者鑑定器」ではない。信頼できる判断には、利用状況、バージョン履歴、人間が責任を持つ審査が必要になる。