Min Wang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション模倣学習ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RePO-VLA: 回復駆動型ポリシー最適化による視覚言語行動モデルVLA2026/5/1
成功軌跡のみの模倣学習では実行時のずれに対処できないため、失敗軌跡を活用して回復行動を学習するフレームワークを提案。成功・回復・失敗の軌跡に役割を割り当て、価値関数で進捗を評価し、ポリシーを改善する。
- 構造的アクショントランスフォーマーによる3次元器用操作マニピュレーション2026/3/1
高自由度ロボットハンドの異種エンボディメント間スキル転移を可能にするため、アクションを時間列ではなく関節軌道の可変長・非順序集合として捉える構造的表現を導入し、3D点群から連続時間フローマッチングで軌道生成するSATを提案した。
- ロボット模倣における行動生成のための粗密分離フレームワーク模倣学習2026/2/1
行動を粗い離散モードと細かい連続行動に分離する2段階手法を提案し、多峰性行動の模倣学習を安定化させ、ベンチマークと実機で性能を向上させた。
- 食品廃棄物選別ロボットのための実環境クラッター把持性能評価ベンチマークマニピュレーション2026/2/1
食品廃棄物選別における不純物除去のため、実環境のクラッター把持性能を評価するベンチマークGRABを提案し、3種のグリッパで1750回の把持試行を行い、把持可否の支配要因と失敗モードを分析した。
- NaviMaster: GUIナビゲーションと身体性ナビゲーションを統合する統一ポリシーの学習VLA2025/8/1
GUI操作と身体性ナビゲーションを同一のMDPとして捉え、視覚的軌跡収集と強化学習で単一のエージェントを訓練し、両タスクで高性能を達成した。
- P-RAG: 具現化された日常タスクの計画のための漸進的検索拡張生成VLA2024/9/1
大規模言語モデルを用いた日常タスク計画において、正解データなしでタスク固有の知識を反復的に蓄積する漸進的検索拡張生成手法を提案し、類似タスクと類似状況のきめ細かい検索で性能を向上させた。
- インスタンス認識型探索・検証・活用によるインスタンス画像ゴールナビゲーションナビゲーション2024/2/1
目標画像に写る特定物体へ未探索環境でたどり着くため、遠くからでも「近づいて確認する」人間の行動を模し、探索・検証・活用を切り替えるナビゲーション手法を提案した。