Reka AIは、新たにオムニモデル「Rho-1」を発表しました。このモデルは、テキスト、画像、動画の理解および生成に加え、ロボット制御までを単一のアーキテクチャで完結させる能力を備えています。
Rho-1は、従来の言語モデルの枠を超え、視覚情報や動的なビデオ入力の解析を高度に行います。最大の特徴は、ロボット工学における実用的なタスク実行能力を統合した点にあります。これにより、推論から物理的なアクションの指示までを一貫したAIモデルで制御可能になります。
単一モデルで多様なモダリティ(テキスト、画像、ビデオ、ロボット制御)を扱う本モデルは、複数の専門モデルを組み合わせる必要性を低減し、システム構成を簡素化します。Reka AIは、高度な推論能力とマルチモーダル入力を融合させることで、AIが物理世界と相互作用するための基盤技術の提供を目指しています。
本モデルにより、自律走行や産業用ロボット制御におけるAIの適用範囲拡大が期待されます。今後、特定のロボット環境に最適化された実装が進むことで、実世界におけるAI活用の可能性がさらに広がると見込まれます。