Zhaojing Yang
収録論文 5本 ・ フィジカルAI/ロボット学習
模倣学習VLA報酬学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットが人間より上手くなる:制約付き実演者からの学習模倣学習2025/10/1
制約のある実演から状態のみの報酬を推定し、より短く効率的な軌道を探索することで、模倣学習を超える性能を実現した。
- NaVILA: 脚式ロボットのための視覚-言語-行動モデルによるナビゲーションVLA2024/12/1
脚式ロボットの視覚言語ナビゲーションにおいて、VLAモデルで「75cm前進」のような中間行動を生成し、それを強化学習による歩行ポリシーで実行する2階層フレームワークを提案した論文。
- 比較言語フィードバックによる軌道改善と報酬学習報酬学習2024/10/1
軌道データと言語フィードバックを統合した潜在空間を学習し、比較言語フィードバックからロボット軌道を反復改善しつつ人間の選好を報酬関数として学習する手法を提案した。
- Collision Avoidance and Navigation for a Quadrotor Swarm Using End-to-end Deep Reinforcement Learning2023/9/1
- QuadSwarm: A Modular Multi-Quadrotor Simulator for Deep Reinforcement Learning with Direct Thrust Control2023/6/1