Lakshita Dodeja
収録論文 2本 ・ フィジカルAI/ロボット学習
ロボット学習強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BCでQ関数を作る:模倣学習からQ値を抽出してロボット上で強化学習を行うロボット学習2026/5/1
模倣学習(BC)のポリシーからQ関数を抽出し、オンライン強化学習でBCとRLの行動をQ値で切り替えることで、効率的なオフラインからオンラインへの学習を実現する手法Q2RLを提案した。
- 不確かさ推定で残差強化学習を加速する強化学習2025/6/1
ベース方策の不確かさを利用して探索を効率化し、確率的なベース方策にも対応できる残差強化学習手法を提案。シミュレーションと実機で既存手法を上回る性能を示した。