Zizhao Wang
収録論文 16本 ・ フィジカルAI/ロボット学習
ワールドモデル教師なし強化学習階層強化学習ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 因子分解型潜在行動ワールドモデルワールドモデル2026/2/18
動画から潜在行動を学習する際、シーンを複数の独立因子に分解し、各因子が独自の潜在行動を推論・予測するフレームワークFLAMを提案。複数エンティティが同時に動く複雑な環境での予測精度と表現品質を向上させ、下流の政策学習を容易にする。
- SkiLD: 因子間相互作用に導かれた教師なしスキル発見教師なし強化学習2024/10/1
状態を因子に分解し、因子間の多様な相互作用を引き起こすスキルを教師なしで学習する手法を提案。家庭環境ロボットなど長期的な疎報酬タスクで既存手法を上回る。
- 効率的な階層強化学習のための分離された教師なしスキル発見階層強化学習2024/10/1
教師なしで分離されたスキルを学習し、階層強化学習で効率的に再利用する手法DUSDiを提案。
- Dyna-LfLH: 学習された幻覚による動的環境での俊敏なナビゲーション学習ナビゲーション2024/3/1
過去の成功体験から動的障害物を潜在分布で生成する自己教師あり学習により、動的環境での安全な経路計画を実現し、成功率を最大25%向上させた。
- Building Minimal and Reusable Causal State Abstractions for Reinforcement Learning2024/1/1
- ELDEN: Exploration via Local Dependencies2023/10/1
- Learning to Correct Mistakes: Backjumping in Long-Horizon Task and Motion Planning2022/11/1
- Autonomous Ground Navigation in Highly Constrained Spaces: Lessons learned from The BARN Challenge at ICRA 20222022/8/1
- From Agile Ground to Aerial Navigation: Learning from Learned Hallucination2021/8/1
- APPLE: Adaptive Planner Parameter Learning from Evaluative Feedback2021/8/1
- APPL: Adaptive Planner Parameter Learning2021/5/1
- CLAMGen: Closed-Loop Arm Motion Generation via Multi-view Vision-Based RL2021/3/1
- APPLI: Adaptive Planner Parameter Learning From Interventions2020/11/1
- APPLR: Adaptive Planner Parameter Learning from Reinforcement2020/11/1
- Maximizing BCI Human Feedback using Active Learning2020/8/1
- Accelerated Robot Learning via Human Brain Signals2019/10/1