Yuanfei Wang
Peking University
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HIL-UMI: ユニバーサルマニピュレーションインターフェースへのVLAモデルのヒューマン・イン・ザ・ループ事後学習の導入VLA2026/9/17
ロボットを使わずにハンドヘルドUMIデモ中に方策を照会し、Energy Scoreで分布外状態を検出してデータ収集を促し、アドバンテージ推定器を更新してVLAモデルを事後学習する枠組みを提案。
- 見ることからシミュレーションへ:デジタルいとこによる高忠実度生成シミュレーションで汎用ロボット学習と評価を実現sim2real2026/4/1
実世界のパノラマ画像から高忠実度のシミュレーションシーンを生成し、さらに多様な「デジタルいとこ」シーンを合成することで、ロボットの汎用学習と評価を効率化する生成フレームワークを提案した。
- ロボット操作におけるワールドモデル評価のためのベンチマーク RoboWM-Benchベンチマーク/ワールドモデル2026/4/1
ロボット操作タスクに特化した、ビデオワールドモデルの物理的実行可能性を評価するベンチマークを提案。生成動画を実行動作に変換し、シミュレーションで検証する。
- IPD: オフライン強化学習における想像的計画蒸留による逐次方策の強化オフライン強化学習2026/3/4
オフライン強化学習の逐次方策モデルに対し、世界モデルと準最適価値関数を用いて劣った軌道を特定し、想像上の最適ロールアウトを生成してデータ拡張と蒸留を行う新しい枠組みIPDを提案した。
- 基盤モデルの推論とパーツグラウンディングによる適応的な関節物体操作マニピュレーション2025/7/1
基盤モデルを活用して関節物体をパーツ単位で認識し、そのアフォーダンスからプリミティブスキルを組み合わせて未知カテゴリの物体も操作できるフレームワークAdaRPGを提案した。
- 視覚-言語-行動モデルサーベイ:行動トークン化の観点からVLA2025/7/1
視覚と言語の入力を行動トークンに変換して実行するVLAモデルを、行動トークンの種類(言語記述・コード・アフォーダンス・軌道など)で分類し、各手法の長所と課題を整理したサーベイ。
- 身体性エージェントと人間の適応のための通信効率の良い欲求アラインメントVLA2025/5/1
家庭支援シミュレーション環境HA-Desireを構築し、曖昧な指示からユーザの潜在的な欲求を推論して適応するフレームワークFAMERを提案した。欲求ベースの心的推論と反省ベースの通信モジュールにより、タスク実行と通信効率を大幅に向上させた。
- AdaManip: 適応的な関節物体操作環境と方策学習マニピュレーション2025/2/1
鍵やドアなど内部状態が見えない関節物体を試行錯誤で操作するための新しいシミュレーション環境と、3D視覚拡散を用いた模倣学習による適応方策を提案した。