Hanyang Yu
Hong Kong University of Science and Technology
収録論文 4本 ・ フィジカルAI/ロボット学習
所属歴(論文より): Hong Kong University of Science and Technology(〜2026) / Tencent Robotics X(〜2026)
模倣学習ワールドモデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MatchingPolicy: 対応関係を考慮したポリシーによる物体横断的な文脈内学習の実現模倣学習2026/8/17
デモとシーンの対応関係を明示的に分離し、密な意味的対応に基づいてロボットの動作を条件付ける拡散ポリシーを導入。未見の物体やカテゴリへの汎化性能を向上させた。
- GeniWorld: 視覚的アクションによるロボット操作のための汎化可能なインタラクティブワールドモデルワールドモデル2026/8/1
事前学習済みビデオ生成モデルとURDFベースのレンダリングを組み合わせ、数値アクションを視覚的アクション表現に変換することで、未見環境へのロバストなゼロショット汎化を実現するインタラクティブワールドモデルを提案した。
- MaskWAM: マスクプロンプトと予測を統合したワールドアクションモデルVLA2026/6/11
ロボット制御のためのワールドアクションモデルに、マスクを入力と予測の両方に統合する手法を提案し、言語の曖昧さを低減して汎化性能を向上させた。
- PoseVLA: 汎用ポーズ事前学習による汎化可能な視覚-言語-行動ポリシーVLA2026/2/1
VLAモデルの特徴崩壊と学習効率の低さを解決するため、カメラ中心の統一空間で3D空間事前知識を抽出する事前学習と、ロボット固有の行動空間への適応を行う事後学習に分離したPose-VLAを提案。離散ポーズトークンにより多様な3Dデータと軌道データを統合し、RoboTwin 2.0で79.5%、LIBEROで96.0%の成功率を達成。