OpenAIは、同社が提供する生成AI「ChatGPT」において、ユーザーとの対話内容の一部を数百名規模の契約作業員がレビュー・確認している実態を公表しました。この取り組みは、AIの安全性維持や品質向上のためのプロセスの一環として実施されています。
ChatGPTの対話ログに対するレビューは、AIが生成する回答の精度向上や、不適切なコンテンツの生成および誤情報の拡散を抑制するために行われています。契約作業員は収集されたデータを元に、AIモデルのトレーニングやファインチューニングに必要なデータセットの適正性を確認しています。
大規模言語モデル(LLM)の高度化には、人間によるフィードバック(RLHF:Reinforcement Learning from Human Feedback)が不可欠です。モデルの挙動を人間にとってより有益かつ安全な方向へ調整するため、数百名体制での監視プロセスを構築し、AIの品質担保と不具合検知を行っています。
OpenAIは今後もAIの安全性研究を継続し、ユーザーのプライバシー保護とモデルの性能向上を両立させるための取り組みを進める方針です。AIの社会実装が加速する中で、こうした透明性の高い監視プロセスは、技術基盤の重要な一部として運用が続けられます。