Anthropicは、同社が提供するAIモデルによって生成されたテキストコンテンツに、自動的にウォーターマーク(電子透かし)を埋め込む機能を導入することを公表しました。この取り組みは、AIによる生成物と人間による記述を技術的に区別可能にし、AIの利用における透明性を確保することを目的としています。
今回発表された機能は、テキスト生成の過程で、人間には視覚的に認識できない微細なパターンを統計的に埋め込む手法を採用しています。これにより、特定の解析ツールを用いることで、そのテキストがAnthropicのAIモデルによって生成されたものかどうかを検証することが可能となります。
AIの普及に伴い、コンテンツの出所に関する懸念が高まっています。Anthropicのこのアプローチは、モデルの出力品質を維持しつつ、デジタルコンテンツの出所を証明するためのセキュリティ層を強化する試みです。コンテンツの自然さを損なうことなく、高い確率で生成元を特定できる点が技術的な特徴です。
Anthropicは、このウォーターマーク技術を今後自社の主要なAIモデル全体に順次展開していく予定です。また、生成AIのエコシステム全体において、コンテンツの信頼性を高めるための標準規格の策定や、業界内での協調体制の構築を継続的に進めていく方針を示しています。