Xinyue Wang
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA世界モデル表現学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ECHO: 手首装着イベントカメラによる過去と未来の文脈を統合したマニピュレーションマニピュレーション2026/9/28
手首装着イベントカメラの観測を圧縮表現に符号化し、過去の把持軌跡と未来のイベント予測を組み合わせて操作方策を学習する手法を提案。露出変動に強く、RLBenchと実機でRGBベースラインを上回る。
- AR-WAM: 視覚条件付きエージェント対応ワールドアクションモデルによるロボットマニピュレーションVLA2026/9/20
言語指示の代わりにバウンディングボックスと操作トークンで条件付けする0.5Bパラメータの世界行動モデルを提案し、エージェント駆動のロボット制御を実現した。
- 因果的にバイアス除去された潜在行動モデルによる身体的行動条件付き世界モデル世界モデル2026/7/1
未ラベル動画から潜在行動を推定する既存モデルは、背景など行動と無関係な要素を混入させる問題を抱える。本論文では、因果的バイアス除去フレームワークCD-LAMを提案し、身体中心の再構成・行動中心の対比学習・潜在空間較正により、制御可能で堅牢な潜在行動表現を実現した。
- SCAR: 自己教師あり連続行動表現学習表現学習2026/5/1
視覚遷移から複数の身体に共通する行動表現を学習する枠組みを提案し、世界モデルの汎化性能を向上させた。