Ganlong Zhao
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーション手動作復元VLAVLA/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FLARE: 視覚言語ロボット操作における自動修正と回復のための障害認識フレームワークマニピュレーション2026/8/27
視覚言語行動モデル(VLA)が実行中に起こす失敗(掴み損ね、落下、衝突など)を自動で修正・回復できるようにするフレームワークを提案。デモに摂動や橋渡しセグメントを注入して「リトライ」能力を、MLLMによる失敗分析で「リセット」スキルを獲得し、オンライン監視で切り替える。
- DreamHand: ビデオ拡散モデルを転用した、遮蔽に頑健な自己中心視点3D手動作復元手動作復元2026/8/20
ビデオ拡散モデルを決定的な幾何エンコーダとして転用し、遮蔽やフレーム外の手の動きを復元する新しい手法を提案。5つのベンチマークでSOTAを達成し、特に遮蔽の多いデータで誤差を大幅に削減した。
- ACE-Ego-0: 自己中心視点の人間とロボットデータを統合したVLA事前学習VLA2026/6/1
ロボットの軌跡データ収集のコストを抑えるため、大規模な自己中心視点の人間ビデオを擬似行動ラベルに変換し、ロボットデータと統合してVLAモデルを事前学習するフレームワークを提案した。
- 階層的アドバンテージ重み付けによるスパースなエピソード結果からのVLAオンラインRL微調整VLA/強化学習2026/6/1
事前学習済みVLAポリシーをオンライン強化学習で微調整する際、エピソードごとの成功/失敗のみのスパースな報酬を、生存性と効率性の2つの目的に分離し、状態適応的に重み付けして遷移レベルの学習信号を生成する手法を提案した。