Google DeepMindは、ロボット工学向けの次世代AIモデル「Gemini Robotics 2」を発表しました。本技術は、卓上マニピュレーターから複雑な動作を必要とするヒューマノイドまで、あらゆる形状やサイズのロボットを制御可能にすることを目的として設計されています。
Gemini Robotics 2は、GoogleのマルチモーダルAI「Gemini」の推論能力をロボット制御に応用したモデルです。ロボットは周囲の状況を視覚的・空間的に理解し、高度な判断に基づいた動作が可能となります。これにより、プログラムされた定型動作ではなく、状況に応じて柔軟な意思決定を行うことが可能となりました。
本モデルの最大の特徴は、圧倒的な汎用性にあります。従来、ロボット制御は特定の環境やタスクごとに個別の調整が必要でした。Gemini Robotics 2は、大規模な学習データと高度な推論エンジンを活用することで、異なるプラットフォーム間での知識共有と適応を実現しています。これにより、ハードウェアとソフトウェアの分断を解消し、より知的なロボットの社会実装を加速させることが期待されます。
Google DeepMindは、本技術を多様なロボットプラットフォームに適用し、産業用から家庭用まで幅広い領域での活用を目指します。現時点で詳細なリリーススケジュールは未定ですが、今後さらなる精度向上とプラットフォームの拡充が進められる見込みです。