Arunabh Bora
収録論文 3本 ・ フィジカルAI/ロボット学習
sim2real軌道計画強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 報酬ハッキングを超えて:段階的人型学習パイプラインの4層におけるプロキシ乖離sim2real2026/10/2
脚式ロボットの強化学習パイプラインを構成する4つのプロキシ(報酬・カリキュラム・評価・参照動作)がそれぞれ目標から乖離する仕組みを分析し、各層の代替定式化を提案。シミュレーション人型ロボットのPPO学習で実測例を示す。
- 動的環境におけるロボット軌道計画アルゴリズムとソフトウェア実装の比較分析軌道計画2024/7/1
動的で複雑な環境におけるロボットの軌道計画アルゴリズムとソフトウェア実装を比較し、適応性やリアルタイム性の課題を整理した調査論文。
- 倉庫ロボットのグリッド環境における対話型強化学習アルゴリズムの比較分析強化学習2024/7/1
仮想グリッド倉庫環境でQ学習とSARSAという2つの対話型強化学習アルゴリズムを同一人物のフィードバックで訓練し、性能を比較した研究。