Anurag Aribandi
収録論文 1本 ・ フィジカルAI/ロボット学習
逆強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間フィードバックによる表現アラインメントを用いた、品質混在の実演からの異形態間報酬学習逆強化学習2024/8/1
品質が混在する実演データから、人間のフィードバックを活用して表現を整列させ、異なる身体形態のロボット間で転移可能な報酬関数を学習する手法を提案した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
品質が混在する実演データから、人間のフィードバックを活用して表現を整列させ、異なる身体形態のロボット間で転移可能な報酬関数を学習する手法を提案した。