Jonaid Shianifar
収録論文 2本 ・ フィジカルAI/ロボット学習
多目的強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 後知恵選好リプレイによる選好条件付き多目的強化学習の改善多目的強化学習2026/1/8
多目的強化学習において、保存された遷移を別の選好で再ラベル付けする後知恵選好リプレイ(HPR)を提案し、CAPQLの性能を向上させた。
- 適応型ロボットアーム制御のための深層強化学習の最適化マニピュレーション2024/7/1
7自由度ロボットアーム制御において、TPEによるハイパーパラメータ最適化がSACとPPOの性能を大幅に向上させることを示した研究。