Anthropicは、同社が提供するAIモデル「Claude」の全出力に対して、グローバル規模で電子透かし(ウォーターマーク)を導入したことを発表しました。この措置により、生成されたコンテンツの由来を技術的に証明し、AIの透明性を確保する体制を強化します。
今回の発表では、Claudeから出力されるすべての回答に対して、不可視のマーカーを付与する仕組みが実装されました。このマーカーは、生成後のテキストに対して一部の編集や改変が行われた場合でも、一定の耐性を持ち、AI生成物であることを識別できるように設計されています。
デジタルコンテンツの真偽や出自が問われるAI時代において、AI生成物を識別する技術は不可欠です。Anthropicが導入した技術は、テキストの構造や統計的特性を微細に調整することで透かしを埋め込んでおり、単なる追記や一部の削除といった編集操作を受けても、AI生成物としての痕跡が維持される点に特徴があります。
Anthropicは、AIの安全性と透明性の確保に向けた取り組みの一環として、この技術をグローバルに展開します。今後も生成AIの信頼性向上を目指し、技術的な精度や改変に対する耐性の強化を継続していく方針です。