Vivek Myers
収録論文 9本 ・ フィジカルAI/ロボット学習
目標条件付き強化学習マルチエージェント強化学習VLA模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- スケーラブルな目標条件付き強化学習のためのマルチステップ準距離学習目標条件付き強化学習2025/11/1
マルチステップモンテカルロリターンを用いて準距離を学習するオフライン目標条件付き強化学習手法を提案し、長期的な視覚タスクや実世界のロボット操作で有効性を示した。
- マルチエージェント逆Q学習による模倣学習マルチエージェント強化学習2025/3/1
他エージェントの方策で周辺化したクリティックを学習し、単一エージェントのsoft-Q IRLの最適化基準を適用することで、マルチエージェントの逆強化学習を高効率化した手法MAMQLを提案。
- 時間表現アラインメント:後継特徴がロボット指示追従における創発的な構成性を可能にするVLA2025/2/1
現在と将来の状態表現を時間的に整合させる損失で学習することで、明示的なサブタスク計画や強化学習なしに、基本タスクの組み合わせからなる複合タスクをこなせる構成性がロボット操作タスクで向上することを示した論文。
- 言語最適化による方策適応:少数ショット模倣のためのタスク分解模倣学習2024/8/1
視覚言語モデルによるタスク分解を活用し、少数の実演から未知の長期的ロボット操作タスクに適応する手法PALOを提案した。
- BridgeData V2: A Dataset for Robot Learning at Scale2023/8/1
- Goal Representations for Instruction Following: A Semi-Supervised Language Interface to Control2023/7/1
- Toward Grounded Commonsense Reasoning2023/6/1
- Active Reward Learning from Online Preferences2023/2/1
- Learning Multimodal Rewards from Rankings2021/9/1