Amrit Bedi
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAマルチエージェント強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VARP: 視覚言語モデルのフィードバックとエージェント正則化選好による強化学習VLA2025/3/1
軌跡スケッチを重ねた画像でVLMの選好ラベル精度を高め、エージェントの性能で報酬学習を正則化することで、連続制御タスクの成功率とリターンを大幅に改善した手法。
- 合同実演を超えて:効率的なマルチエージェント強化学習のための個別専門家ガイダンスマルチエージェント強化学習2024/3/1
各エージェント個別の専門家実演を選択的に活用し、協調行動を学習するマルチエージェント強化学習手法PegMARLを提案。