OpenAIは、同社の最新AIモデル「GPT-5.6 Sol」が、汎用的な推論能力を測定する難関ベンチマーク「ARC-AGI-3」において、Opus 5のスコアを上回る性能を達成したことを発表しました。
今回発表された「GPT-5.6 Sol」は、最新のAPI環境で動作します。モデル本体の性能に加え、特定の2つの追加設定を組み合わせることで、複雑な推論タスクにおける処理能力が向上することが示されました。
ARC-AGI(Abstraction and Reasoning Corpus)は、AIの論理的推論能力や抽象的な思考力を評価するための非常に難易度の高いテストとして知られています。今回のGPT-5.6 Solの結果は、既存の主要な競合モデルであるOpus 5と比較して、推論の正確性と効率性において進展があったことを示唆しています。
OpenAIは、引き続きAPIを通じたモデルの提供と改善を進めていく方針です。今回の成果は、AIがより複雑な論理構造を解釈し、高度な推論タスクをこなすための道筋がさらに明確になったことを示しており、AGI(汎用人工知能)開発に向けた重要な一歩となります。