Alec Koppel
収録論文 9本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習RLHF
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 合同実演を超えて:効率的なマルチエージェント強化学習のための個別専門家ガイダンスマルチエージェント強化学習2024/3/1
各エージェント個別の専門家実演を選択的に活用し、協調行動を学習するマルチエージェント強化学習手法PegMARLを提案。
- MaxMin-RLHF:多様な人間選好へのアラインメントRLHF2024/2/1
単一報酬モデルのRLHFでは人間選好の多様性を表現できないことを示し、選好分布の混合をEMで学習して平等主義的なMaxMin目的で方策を最適化する手法を提案した論文。
- Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation2023/6/1
- Dealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policies2022/6/1
- Distributed Riemannian Optimization with Lazy Communication for Collaborative Geometric Estimation2022/3/1
- Distributed Gaussian Process Mapping for Robot Teams with Time-varying Communication2021/10/1
- Composable Learning with Sparse Kernel Representations2021/3/1
- Dense Incremental Metric-Semantic Mapping for Multi-Agent Systems via Sparse Gaussian Process Regression2021/3/1
- Asynchronous and Parallel Distributed Pose Graph Optimization2020/3/1