ロボット工学の分野に新たな革新をもたらす汎用AIモデル「GEN-1.5」が、Physical Intelligence社より発表されました。本モデルは、ロボットが未経験のタスクをわずか1回のデモンストレーションを見るだけで習得し、実行に移せる能力を備えています。
GEN-1.5の最大の特徴は、人間による単一の操作デモを視覚的に理解し、その動きを模倣・応用する機能です。従来のロボット学習のように数千回の試行錯誤や大規模なシミュレーションデータセットを必要とせず、短時間で実用的な動作を学習することが可能となりました。
従来、ロボットの動作プログラミングは特定の環境やタスクに最適化された個別開発が主流でした。GEN-1.5は汎用的な基盤モデルとして設計されており、複雑なタスクに対しても視覚情報を直接解釈することで柔軟に対応します。これにより、開発コストの大幅な削減と、未知の環境におけるロボットの適応力向上が期待されます。
今後は、より多様なハードウェア環境への適応や、複雑なマルチステップタスクの処理能力強化が進められる見込みです。物理世界での身体的作業を学習・遂行するAIの能力は、製造・物流・サービス産業の自動化を加速させる重要な鍵となります。