AI開発企業のAnthropicは、同社の生成AI「Claude」が作成したテキストを第三者が識別可能にする、新しいウォーターマーク(電子透かし)検出APIを発表しました。
今回発表されたAPIは、Claudeによって生成されたテキスト内に含まれる微細な特徴を検出し、そのコンテンツがAIによって生成されたものである可能性を判定する仕組みです。外部の開発者や組織は、本APIを活用することで、自社のプラットフォーム等でAI生成コンテンツを識別することが可能となります。
生成AIの普及に伴い、人間が書いた文章とAIが作成した文章の判別が困難になっています。Anthropicは透明性と信頼性の向上を目指し、技術的な解決策としてこの検出APIを提供します。本技術は、AI生成コンテンツであることを特定する一つの手法として、AIの責任ある利用を支える基盤となることが期待されています。
Anthropicは、このAPIを通じて第三者によるAI利用のモニタリングや識別を支援し、安全で責任あるAI活用を促進するための環境整備を進めていく方針です。