Junseo Lee
収録論文 1本 ・ フィジカルAI/ロボット学習
安全強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Safe CoR: 制約報酬を用いた模倣学習と安全強化学習の二重エキスパート統合安全強化学習2024/7/1
性能重視と安全重視の2種類のエキスパート模倣を制約報酬で統合し、安全性と性能を両立させる枠組みを提案。実機Jackalで性能39%向上・制約違反88%削減を達成。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
性能重視と安全重視の2種類のエキスパート模倣を制約報酬で統合し、安全性と性能を両立させる枠組みを提案。実機Jackalで性能39%向上・制約違反88%削減を達成。