Ajay Sridhar
収録論文 10本 ・ フィジカルAI/ロボット学習
VLA/クロスエンボディメント転移VLA/プランニングマニピュレーションナビゲーション社会ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 行動整合表現によるクロスエンボディメント転移VLA/クロスエンボディメント転移2026/7/1
ロボット操作の大規模模倣学習において、行動整合表現(物体のバウンディングボックスや言語動作、エンドエフェクタの軌跡など)がVLAモデルのクロスエンボディメント転移を促進するかを検証し、シミュレーションベンチマークで評価。エンドエフェクタ軌跡が特に有効で、シミュレーションから実機への転移成功率を28%向上させた。
- DIRECT: 身体化プランナーにおけるテスト時計算の割り当てはいつ、どこで行うべきか?VLA/プランニング2026/6/10
VLMを高レベルプランナーとして使う際、テスト時計算を増やすと性能が上がるが、コストも増える。シーン文脈に基づいて計算をルーティングするDIRECTを提案し、成功率とコストのトレードオフを改善した。
- MemER: 経験検索によるロボット制御のための記憶の拡張マニピュレーション2025/10/1
ロボット政策に長期記憶を持たせるため、過去の重要フレームを選択・追跡する高レベル政策と、それに基づく低レベル政策の階層型フレームワークを提案し、実世界の長期的操作タスクで性能を向上させた。
- LeLaN: 実世界動画から言語条件付きナビゲーション方策を学習ナビゲーション2024/10/1
大規模視覚言語モデルとロボット基盤モデルを活用し、ラベルなし・行動なしの一人称視点動画から言語で指示された物体ナビゲーション方策を学習する手法を提案。1000回以上の実世界実験で既存手法を上回り、エッジ計算で4倍高速に推論可能。
- SELFI: 強化学習による社会ナビゲーションのための自律的自己改善社会ナビゲーション2024/3/1
オフラインのモデルベース学習で事前学習した方策を、オンラインのモデルフリー強化学習で微調整する手法を提案し、実環境での衝突回避と社会的配慮行動を改善した。
- NoMaD: Goal Masked Diffusion Policies for Navigation and Exploration2023/10/1
- ViNT: A Foundation Model for Visual Navigation2023/6/1
- SACSoN: Scalable Autonomous Control for Social Navigation2023/6/1
- GNM: A General Navigation Model to Drive Any Robot2022/10/1
- ExAug: Robot-Conditioned Navigation Policies via Geometric Experience Augmentation2022/10/1