Alexander Ororbia
収録論文 4本 ・ フィジカルAI/ロボット学習
模倣学習人間-ロボット協調VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 限られたデモデータ下での嗜好後悔によるニューロロボット方策最適化模倣学習2026/4/1
デモデータが少ない環境でロボットが複雑な行動を学習できるよう、自己模倣フレームワークMYOEと嗜好後悔を用いた方策最適化手法を提案した。
- オフポリシー評価による人間-ロボット協調のための強化学習の定式化人間-ロボット協調2026/2/1
実環境や人間のフィードバックなしに、記録済みの対話データのみを用いてオフポリシー評価で状態表現と報酬関数を選択する強化学習フレームワークを提案し、Lunar LanderとNASA-MATB-IIで検証した。
- R-AIF: 能動的推論と世界モデルによる疎報酬ロボットタスクの画素からの解決VLA2024/9/1
部分観測マルコフ決定過程(POMDP)下で、画素入力と疎な報酬から連続行動を学習する能動的推論エージェントを提案し、事前選好学習と自己修正スケジュールで性能を向上させた。
- Active Predicting Coding: Brain-Inspired Reinforcement Learning for Sparse Reward Robotic Control Problems2022/9/1