Shengjie Wang
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 曖昧な指示に対するアフォーダンス認識型インタラクティブ意思決定と実行VLA2026/2/1
曖昧な人間の指示に対し、対話的な探索と視覚言語推論を統合した二重ストリーム枠組みAIDEを提案し、ゼロショットでアフォーダンス解析と指示解釈を実現した。
- ナイトメア・ドリーマー:危険状態を夢見て先回りする安全強化学習安全強化学習2026/1/1
学習した世界モデルで将来の安全違反を予測し、それを避けるように行動計画を立てるモデルベース安全強化学習手法を提案。画像入力のみで安全性と効率を大幅に改善した。
- 後知恵オンライン模倣によるフローから方策への変換模倣学習2025/12/1
高レベルプランナが生成した2D点フローを、オンライン試行錯誤と後知恵目標再ラベリングで目標条件付き模倣方策に接地し、操作タスクの性能を2倍以上に改善する手法を提案。
- MotionTrans: 人間のVRデータでロボットマニピュレーション方策の動作レベル学習を実現マニピュレーション2025/9/1
VRで収集した人間の動作データを変換し、ロボットデータと重み付き共訓練することで、13タスクの動作をエンドツーエンド方策へ直接転移。9タスクはゼロショットで成功し、事前学習・微調整性能も40%向上。
- 視覚運動ポリシーに固有感覚状態は必要か?VLA2025/9/1
固有感覚入力を排除し視覚のみで動作を予測するState-free Policyを提案し、空間汎化性能が大幅に向上することを示した。
- 事前強化学習:限られた試行回数での目標条件付き動的マニピュレーションマニピュレーション2025/5/1
少数の実演から条件付き拡散モデルで運動マニフォールドを学習し、低次元条件空間でのフィードバック最適化により、10回程度の試行で新しい動的マニピュレーション目標を達成するフレームワークを提案。
- EasyInsert: データ効率が高く汎化可能な挿入ポリシーマニピュレーション2025/5/1
人間の直感に基づき挿入をデルタポーズ回帰問題として定式化し、最小限の人手で収集したデータからエンドツーエンドの視覚ポリシーを学習。未知物体や乱雑環境でも高いゼロショット汎化性能を実現した。
- SKIL: 意味的キーポイント模倣学習による汎化性とデータ効率に優れたマニピュレーションマニピュレーション2025/1/1
視覚基盤モデルで意味的キーポイントを自動抽出し、少ないデモ数で複雑なロボット操作を模倣学習できるフレームワークを提案。
- Navi2Gaze: 基盤モデルを活用したナビゲーションと対象物注視ナビゲーション2024/7/1
視覚言語モデル(VLM)を使い、タスク記述に基づいてロボットが対象物に対して適切な位置と向きを自動で選び、効率的に移動・注視する手法を提案した論文。
- SpaceOctopus: タコに着想を得た多腕宇宙ロボットの運動計画フレームワーク宇宙ロボット/運動計画2024/3/1
タコの腕の分散制御に着想を得て、多腕宇宙ロボットのための多階層分散型運動計画フレームワークを開発し、マルチエージェント強化学習と統合することで、ベース姿勢調整や外乱・腕の故障に対する堅牢性を実現した。
- CoPa: 基盤モデルと部位の空間制約による汎用ロボットマニピュレーションマニピュレーション2024/3/1
基盤モデルの常識知識を活用し、タスク指向の把持部位選択とタスクに応じた空間制約から6自由度エンドエフェクタ姿勢を生成する、追加学習不要の汎用マニピュレーション手法。
- EfficientZero V2:限られたデータで離散・連続制御をマスターする強化学習2024/3/1
限られたデータで効率的に学習できる強化学習フレームワークEfficientZero V2を提案し、連続・離散行動や視覚・低次元入力など多様なタスクで既存手法を上回る性能を示した。
- Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own2023/10/1
- DexCatch: Learning to Catch Arbitrary Objects with Dexterous Hands2023/10/1
- i-Octree: A Fast, Lightweight, and Dynamic Octree for Proximity Search2023/9/1
- A Learning-based Adaptive Compliance Method for Symmetric Bi-manual Manipulation2023/3/1
- Efficient Exploration Using Extra Safety Budget in Constrained Policy Optimization2023/2/1
- A Policy Optimization Method Towards Optimal-time Stability2023/1/1
- Reinforcement Learning with Prior Policy Guidance for Motion Planning of Dual-Arm Free-Floating Space Robot2022/9/1
- A Learning System for Motion Planning of Free-Float Dual-Arm Space Manipulator towards Non-Cooperative Object2022/7/1
- Towards Human-Level Bimanual Dexterous Manipulation with Reinforcement Learning2022/6/1