Sinan Ibrahim
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習/制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 批評家をリアプノフ関数として用いる安定化強化学習エージェント強化学習/制御2024/9/1
批評家ネットワークをリアプノフ関数として扱い、モデルフリーで各エピソード中に動的システムの安定性を保証する強化学習エージェントCALFを提案し、移動ロボットシミュレータで学習性能の向上を示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
批評家ネットワークをリアプノフ関数として扱い、モデルフリーで各エピソード中に動的システムの安定性を保証する強化学習エージェントCALFを提案し、移動ロボットシミュレータで学習性能の向上を示した。