Runpeng Xie
収録論文 2本 ・ フィジカルAI/ロボット学習
選好ベース強化学習モデルベースRL
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OPRIDE: データセット内探索によるオフライン選好ベース強化学習選好ベース強化学習2026/2/19
オフライン選好ベース強化学習において、クエリ効率を高めるための探索戦略と割引スケジューリングを組み合わせた手法を提案し、少ないクエリで高性能を達成した。
- MrCoM: マルチシナリオに汎化するメタ正則化ワールドモデルモデルベースRL2025/11/9
同一シミュレータ内の力学特性の共通性を利用し、潜在状態を動的特性ごとに分解してメタ状態・メタ価値正則化を施すことで、複数シナリオに汎化する統一ワールドモデルを構築した。