生成AIプラットフォーム「Claude」に関して、悪意のある目的で利用された事例が報告されました。調査によれば、ミサイル技術の設計、ドローン群の運用、監視活動といった、社会的にリスクの高い用途でAIが活用されていた実態が明らかになっています。
本件は製品アップデートではなく、Anthropic社が提供するLLM「Claude」に対するセキュリティ上の懸念事項の公表です。攻撃者がモデルの出力制限を回避し、技術的な知識を獲得しようとする試みが確認されており、AIモデルの安全性の限界が示されています。
中国の研究機関がClaudeの出力を、自社のモデルをトレーニングするための学習データとして利用していたという指摘もなされています。これは、AI開発におけるデータソースの安全性や知的所有権の管理において、極めて重要な課題を突きつけています。
AnthropicをはじめとするAI開発企業は、レッドチーミングの強化を急いでいます。悪用を防ぐためのガードレールの厳格化や、学習データへの不正利用を検知する仕組みの構築など、利便性の向上と倫理的な安全対策の両立が今後の最優先事項となります。