Yuanliang Ju
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA強化学習プランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RL^2-VLA: テスト時スケーリングによる適応的RL潜在構成ステアリングと視覚言語行動モデルVLA2026/7/1
視覚言語行動モデルの性能低下を改善するため、オフラインRLで学習した軽量ポリシーをVLAの潜在表現に基づいて構成し、失敗が予測される時のみ介入する適応的推論時ステアリング手法を提案した。
- 適応的Qチャンキングによるオフラインからオンラインへの強化学習強化学習2026/5/1
オフラインからオンラインへの強化学習において、状態ごとに最適なアクションチャンクサイズを適応的に選択する手法を提案し、固定サイズの既存手法より高い成功率を達成した。
- HDFlow: 長期的タスクのための階層的拡散フロープランニングプランニング2026/5/1
拡散モデルと整流フローモデルを階層的に組み合わせ、長期的な家具組み立てなどのタスクを効率的に計画する手法を提案した。
- MomaGraph: 視覚言語モデルによる状態認識統合シーングラフと身体性タスクプランニングVLA2025/12/1
家庭内の移動マニピュレータ向けに、空間的・機能的関係と物体状態を統合したシーングラフ表現MomaGraphと、大規模データセット・評価ベンチマーク・強化学習で訓練した7B視覚言語モデルMomaGraph-R1を提案し、ゼロショットタスクプランニングで最先端性能を達成した。
- SAFE: 視覚言語行動モデル向けマルチタスク故障検知VLA2025/6/1
VLAの内部特徴からタスク失敗の可能性を予測する汎用的な故障検知器SAFEを提案し、未見タスクでも高精度・早期検知を実現した。