Reka AIのオムニモデル「Rho-1」がテキスト、画像、動画、ロボット制御を単一モデルで処理
Reka AI's omni-model Rho-1 handles text, images, video, and robot control in a single model
記事のポイント
📰ニュース
Reka AIがテキスト、画像、動画、ロボット制御を単一のニューラルネットワークで処理する190億パラメータのオムニモデル「Rho-1」を発表しました。
🔍注目ポイント
Rho-1は、複数のモダリティを専門システムにルーティングせず、全てをトークンとして共有コンテキストウィンドウで処理する点が画期的です。
🔮これからどうなる
この技術は、ロボットの自律性向上やマルチモーダルAIの統合を加速させ、より汎用的なAIアシスタントの実現に貢献するでしょう。
Rho-1は、320台のH100 GPUで約3ヶ月間学習され、現在のトップモデルが必要とする計算リソースのごく一部で開発されました。
これにより、テキスト、画像、動画の生成に加え、ロボットの制御アクションも単一モデルで実行可能です。
これにより、テキスト、画像、動画の生成に加え、ロボットの制御アクションも単一モデルで実行可能です。
単一モデルでテキスト、画像、動画、ロボット制御までこなせるのはすごいですね。将来的に、私たちの生活でAIがもっと身近になるかもしれません。