Yixing Lan
収録論文 5本 ・ フィジカルAI/ロボット学習
世界モデル模倣学習オフライン強化学習強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Koopman Dreamer:安定した世界モデル想像のためのスペクトル制約付き潜在ダイナミクス世界モデル2026/7/1
Dreamerスタイルの世界モデルにKoopman理論に基づくスペクトル制約付きの決定論的潜在ダイナミクスを導入し、長期ロールアウトの安定性と制御性能を向上させた。
- 拡散モデルによる合成デモンストレーションを用いた敵対的模倣学習模倣学習2025/12/1
拡散モデルで疑似専門家デモを生成し、優先リプレイで効率的に模倣学習する手法を提案。Hopperタスクで最先端を上回る性能を達成。
- 価値条件付き最適化による拡散ポリシーを用いたオフライン強化学習オフライン強化学習2025/11/1
オフライン強化学習において、拡散モデルをアドバンテージ値で重み付けして訓練し、高リターン行動を選択的に拡張することで、保守性と探索性のバランスを取る手法DIVOを提案した論文。
- パラメータ空間におけるスキル拡張と合成強化学習2025/2/1
スキルをLoRAモジュールとして管理し、パラメータ空間で合成・動的選択することで、新たなタスクに効率的に適応する強化学習フレームワークPSECを提案。
- オフライン強化学習のための適応的アドバンテージ誘導方策正則化オフライン強化学習2024/5/1
VAEと拡張挙動方策から高アドバンテージ行動を抽出し、OOD行動への保守性を保ちつつ方策改善を促すオフラインRL手法A2PRを提案。D4RLで最先端性能を達成。