Yihuai Gao
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA継続学習/力覚/ロボット操作マニピュレーション移動マニピュレーション姿勢推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- 多感覚継続学習:事前学習済み視覚運動ポリシーの力覚への適応継続学習/力覚/ロボット操作2026/6/1
事前学習済みの視覚のみのロボットポリシーに、力覚などの新しいモダリティを追加し、元のタスク性能を保ちながら接触を伴う新タスクへ適応させる手法を提案した。
- ゲート付きメモリポリシー:文脈内記憶と適応マニピュレーション2026/4/1
ロボット操作タスクの記憶要件に応じて、履歴を選択的に記憶・想起する視覚運動ポリシーを提案。メモリゲートと軽量クロスアテンションにより、非マルコフ的タスクで性能を向上させた。
- Cosmos Policy: 視覚運動制御と計画のための動画モデル微調整VLA2026/1/1
大規模事前学習済み動画モデルを、アーキテクチャ変更なしの一段階の追加学習だけでロボット方策に変換し、行動・将来画像・価値を潜在フレームとして生成して計画も可能にした手法。
- 統合動画行動モデルVLA2025/3/1
動画と行動を統合的に学習し、推論時は動画生成を省略して高速に行動を予測できるロボティクス向けモデルを提案。
- TidyBot++: ロボット学習のためのオープンソース全方向移動マニピュレータ移動マニピュレーション2024/12/1
模倣学習による家庭内移動マニピュレーションのデータ収集を容易にするため、動力付きキャスタで全方向移動を実現し、任意のアームを搭載できる低コストなオープンソース移動マニピュレータを提案した。スマホ遠隔操作インタフェースで収集したデータから学習した方策が家庭内タスクを実行できることを示した。
- 脚付きUMI:操作中心の全身コントローラによる移動型マニピュレーションマニピュレーション2024/7/1
手持ちグリッパで実世界の操作データを収集し、シミュレーションで全身コントローラを訓練して、四足歩行ロボットに操作スキルを実装するフレームワークを提案。
- CLOSURE: 姿勢不確かさ集合の高速定量化姿勢推定2024/3/1
学習したノイズを含む計測から6D姿勢推定の不確かさを定量化するため、姿勢不確かさ集合(PURSE)の最小包含測地線球を高速に内側近似するアルゴリズムCLOSUREを提案。