Xuhao Zhao
収録論文 1本 ・ フィジカルAI/ロボット学習
安全強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 階層型適応チャンス制約セーフガードによる安全な強化学習安全強化学習2023/10/1
安全回復率を代理チャンス制約として用いる適応的なモデルフリー安全RL手法ACSを提案し、探索中および収束後の安全性を反復的に保証する。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
安全回復率を代理チャンス制約として用いる適応的なモデルフリー安全RL手法ACSを提案し、探索中および収束後の安全性を反復的に保証する。