Anthropicは現在、Claudeモデルが生成するコンテンツにマークを付けている。8月2日以来、同社は生成テキストに不可視の透かしを織り込み、対応する画像ファイルに署名付きメタデータラベルを添付しており、AI生成コンテンツの透明性を高める取り組みを進めている。
透かしの仕組み
テキストの透かしは、隠しタグやメタデータではなく、モデルレベルで埋め込まれる。Anthropicによると、コピーされたテキストにも付随し、一部の編集を経ても残る可能性があり、偶発的に除去することが難しくなっている。同社はこのメカニズムの完全な技術的詳細を公開しておらず、公開検出ツールもまだ発表していないが、近日中に公開すると述べている。
「透かしは、Claudeがコンテンツを生成または処理した可能性があるかどうかをテストするのに役立つだけです」とAnthropicは述べている。「所有権や著作権について何かを示すものではなく、ユーザーの権利を変更するものでもありません」
画像とファイルのC2PAラベル
PNG、JPG、SVG画像などのファイルには、Claudeがファイルのメタデータに、そのファイルがClaudeで作成または処理されたことを示す暗号署名付きの小さなメモであるコンテンツクレデンシャルを添付する。このラベルは、カメラメーカーや写真編集ソフトウェアが画像の出所を記録するために使用しているのと同じC2PAオープン規格を使用している。C2PA対応ツールは誰でも読み取ることができ、署名付き記録により改ざんを検出できる。
作家と開発者の反応
この展開には様々な反応がある。Anthropicは、この変更はEU AI法に基づくAI生成コンテンツの透明性に関する欧州委員会の行動規範へのコミットメントに従ったものだと述べている。一部の作家や開発者は来歴ラベルを歓迎したが、隠されたテキスト透かしには、ユーザーの明確な同意なしに書かれた作品を変更し、現時点では秘密鍵を保持するAnthropicだけが検証できると異議を唱えた。一方、規制当局やファクトチェッカーは、コンテンツの出所を追跡するための有用なツールと見なしている。