Fahim Shahriar
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーション強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 物体検出を活用した目標条件付き強化学習による汎用的なマニピュレーションマニピュレーション2025/7/1
事前学習済み物体検出モデルでテキスト指示から対象物を特定し、マスクベースの目標条件付けを行うことで、未知の物体にも対応できる汎用的なリーチ・把持を強化学習で実現した。
- 実機ロボットにおける同期型強化学習と非同期型強化学習の比較強化学習2025/3/1
Franka Emika Pandaロボットアームを用いて、同期型と非同期型の強化学習を比較し、非同期型の方が学習が速く、より高いリターンを得られることを示した。
- 目標到達強化学習におけるスパース報酬の再検討強化学習2024/7/1
目標到達タスクにおいて、最小時間タスクとして定式化したスパース報酬が高品質な方策の学習を促進し、密報酬を上回ることを示し、初期方策の目標到達率が成功の早期指標となることを明らかにした。