Ke Jiang
収録論文 3本 ・ フィジカルAI/ロボット学習
オフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オフライン強化学習のための変分OOD状態補正オフライン強化学習2025/5/1
オフライン強化学習において、データ密度を考慮した安全知覚(DASP)により分布外状態を補正し、安全な領域への誘導を図る手法を提案した。
- 非専門家デモを超えて:オフライン強化学習のための結果駆動型行動制約オフライン強化学習2025/4/1
非専門家による質の低いデモデータでも安全に学習できるよう、行動の生起確率ではなく結果が安全領域に収まるかで評価する新しい保守的報酬機構ODAFを提案し、MuJoCoや迷路タスクで有効性を示した論文。
- Contextual Conservative Q-Learning for Offline Reinforcement Learning2023/1/1