Xinhu Li
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーション模倣学習強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- エージェント事前分布に導かれた政策学習マニピュレーション2026/9/28
各スキルの構造的事前分布を政策のインターフェースとして用いることで、スキルの汎化と新規タスクへの組み合わせを両立させる手法APPLを提案。
- ロボットが人間より上手くなる:制約付き実演者からの学習模倣学習2025/10/1
制約のある実演から状態のみの報酬を推定し、より短く効率的な軌道を探索することで、模倣学習を超える性能を実現した。
- 複雑なQ関数における決定論的方策勾配の準最適性の緩和強化学習2024/10/1
強化学習において、Q関数の局所最適に陥りやすい問題を解決するため、複数の行動候補から最良を選び、Q関数を繰り返し近似するSAVOアーキテクチャを提案し、複雑なタスクでの性能向上を実証した。