Google DeepMindは、ボードゲーム「Stratego(ストラテゴ)」において、世界トップレベルの人間プレイヤーに対してAIが勝利したことを発表した。ストラテゴは、情報の非対称性が強く、戦略的推論が不可欠なゲームであり、長らくAIにとっての「最後の砦」の一つとみなされてきた。
今回、DeepMindが開発したAIモデル「DeepNash」は、ストラテゴの複雑なルールと未知の情報を処理する能力を備えている。人間プレイヤーとの対戦において、DeepNashは高い勝率を記録し、世界的な強豪プレイヤーを相手に圧倒的な実力を示した。この成果は、AIがゲームという枠組みを超えて、複雑な意思決定タスクにおいて人間を凌駕しつつあることを示している。
ストラテゴはチェスや囲碁とは異なり、相手の駒の配置が見えない「不完全情報ゲーム」である。そのため、単なる計算量だけでなく、ブラフや予測といった心理的・戦術的な駆け引きが必要となる。DeepNashは、モデルフリーのマルチエージェント深層強化学習技術を活用し、ゲームを通じて自己学習を行うことで、複雑な環境下での最適な戦略を自律的に構築した。
今回の成功は、不完全情報ゲームに対するAIの適応能力が大幅に向上したことを示す。DeepMindは、この技術が現実世界の不確実性が伴う課題解決に応用できる可能性を示唆しており、今後もより複雑な意思決定アルゴリズムの研究を推進していく。