Runze Xu
Tsinghua University
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/アクションチャンキングマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboDrop: 局所勾配適合性によるVLA事後学習データのキュレーションVLA2026/9/9
VLAモデルの事後学習データに含まれる誤りを、学習中の局所勾配の適合性を指標に自動で検出・除去するデータキュレーション手法を提案。
- 停止タイミングの学習:VLAにおける内部クロスアテンション動態を用いた適応的アクションチャンキングVLA/アクションチャンキング2026/9/1
固定長のアクションチャンキングの限界を克服するため、アクションエキスパート内のクロスアテンションのエントロピー上昇を検出し、実行中に動的にチャンク長を調整するトレーニング不要の手法を提案した。
- 動作焦点の潜在アクションによる人間のエゴビデオからのクロスエンボディVLA訓練VLA2026/6/1
ラベルなしの人間のエゴビデオから動作の潜在アクションを抽出し、ロボットのVLAモデルを訓練する手法を提案。シミュレーションと実環境で、わずか50トラジェクトリの適応で大規模データセットで訓練した最先端モデルと同等の性能を達成。
- ManipArena:推論指向の汎用ロボットマニピュレーションの実世界包括評価マニピュレーション2026/3/1
実機ロボットでのマニピュレーション汎化を公平に評価するため、20タスク・1万超の専門家軌道・約188時間分のデータを備えた標準化ベンチマークを構築し、VLAやワールドアクションモデルなど7構成を比較した。