Roman Zashchitin
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習/制御強化学習/安全制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 批評家をリアプノフ関数として用いる安定化強化学習エージェント強化学習/制御2024/9/1
批評家ネットワークをリアプノフ関数として扱い、モデルフリーで各エピソード中に動的システムの安定性を保証する強化学習エージェントCALFを提案し、移動ロボットシミュレータで学習性能の向上を示した。
- 形式的目标到達保証を備えた新規エージェント:移動ロボットによる実験的検証強化学習/安全制御2024/9/1
安全なモデルフリー強化学習エージェントCALFを提案し、目標状態への到達を形式的に保証しつつ、TurtleBot3 Burgerでの実験でPPOを上回る性能を示した。