Shibo Xia
収録論文 1本 ・ フィジカルAI/ロボット学習
マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReF-HIL: 人間の行動近傍を中心に批評器を形成する効率的なHuman-in-the-Loop強化学習マニピュレーション2026/9/29
人間の成功体験から価値参照を学習し、人間行動の近傍領域を定義することで、模倣ペナルティを避けつつ実世界のマニピュレーションを効率的に強化学習する手法を提案。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
人間の成功体験から価値参照を学習し、人間行動の近傍領域を定義することで、模倣ペナルティを避けつつ実世界のマニピュレーションを効率的に強化学習する手法を提案。