David McAllister
収録論文 3本 ・ フィジカルAI/ロボット学習
行動クローニング強化学習全身制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オープンデータ・訓練・評価によるスケーラブルな行動クローニング行動クローニング2026/6/1
大規模な遠隔操作データセットABC-130K(3500時間、13万エピソード)とオープンソースのハードウェア・訓練・シミュレーション基盤を公開し、行動クローニングの再現可能な研究基盤を提供した。
- フローマッチング方策勾配強化学習2025/7/1
フローマッチングを方策勾配法に統合したFPOを提案し、拡散スタイルの方策を連続制御タスクで学習できることを示した。
- 視覚的模倣による文脈依存型ヒューマノイド制御全身制御2025/5/1
日常動画から人間と環境を再構成し、階段昇降や椅子への着座など周囲の状況に応じた全身制御方策をヒューマノイドに学習させるreal-to-sim-to-realパイプラインを提案。