Ruslan Salakhutdinov
収録論文 34本 ・ フィジカルAI/ロボット学習
力覚推定/模倣学習マニピュレーションsim2realVLA動作計画指示追従VLA/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FACTR 2: コモディティロボットアームの外力センシング学習がポリシー学習を向上させる力覚推定/模倣学習2026/6/1
専用の力センサーを持たないロボットアームでも、データ駆動で外力トルクを推定するNEXTと、接触前後のデータを重点的に学習するFIRSTを組み合わせることで、力覚を活用した遠隔操作とポリシー学習を可能にした論文。
- FACTR: 接触の多いタスクのための力覚に注目させるカリキュラム学習マニピュレーション2025/2/1
力覚フィードバックを双方向テレオペで収集し、視覚入力を徐々に劣化させるカリキュラムで力覚に注目させる方策学習手法を提案。未見物体への汎化性能を43%向上させた。
- 局所ポリシーによるゼロショット長期的マニピュレーションsim2real2024/10/1
ロボットの絶対姿勢や物体配置に依存しない「局所ポリシー」を基盤モデルと組み合わせ、シミュレーションから実機へのゼロショット転移で最大8段階の長期タスクを実現した。
- Embodied-RAG: 具現化エージェントのための汎用ノンパラメトリック記憶検索生成VLA2024/9/1
ロボットの探索で得たマルチモーダルな知識を階層的な「意味の森」として記憶し、ナビゲーションや言語生成に活用するRAGフレームワークを提案した。
- Neural MP: 汎用ニューラル動作計画器動作計画2024/9/1
シミュレーションで大量の複雑シーンと専門家データを生成し、反応的な汎用方策へ蒸留して軽量最適化と組み合わせることで、実世界の動作計画を高速かつ高成功率で実現した。
- 状況依存型指示追従指示追従2024/7/1
人間がその場で発する曖昧で時間的に変化する指示を、過去の行動や文脈から解釈してロボットが実行する「状況依存型指示追従」を提案し、既存のEIFモデルが人間の意図を十分に理解できないことを示した。
- Plan-Seq-Learn: 言語モデルで誘導する強化学習による長期的ロボティクスタスクの解法VLA/強化学習2024/5/1
LLMの高レベル計画と運動計画を組み合わせ、事前定義されたスキルなしで強化学習を効率的に誘導し、最大10段階の長期的ロボティクスタスクを視覚入力から85%以上の成功率で解く手法を提案。
- Contrastive Example-Based Control2023/7/1
- Imitating Task and Motion Planning with Visuomotor Transformers2023/5/1
- Self-Supervised Object Goal Navigation with In-Situ Finetuning2022/12/1
- Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One Objective2022/9/1
- A Simple Approach for Visual Rearrangement: 3D Mapping and Semantic Search2022/6/1
- SEAL: Self-supervised Embodied Active Learning using Exploration and 3D Consistency2021/12/1
- Accelerating Robotic Reinforcement Learning via Parameterized Action Primitives2021/10/1
- Mismatched No More: Joint Model-Policy Optimization for Model-Based RL2021/10/1
- Recurrent Model-Free RL Can Be a Strong Baseline for Many POMDPs2021/10/1
- Replacing Rewards with Examples: Example-Based Policy Search via Recursive Classification2021/3/1
- On Proximal Policy Optimization's Heavy-tailed Gradients2021/2/1
- Unsupervised Domain Adaptation for Visual Navigation2020/10/1
- Object Goal Navigation using Goal-Oriented Semantic Exploration2020/7/1
- Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers2020/6/1
- Neural Topological SLAM for Visual Navigation2020/5/1
- Weakly-Supervised Reinforcement Learning for Controllable Behavior2020/4/1
- Learning to Explore using Active Neural SLAM2020/4/1
- Rewriting History with Inverse RL: Hindsight Inference for Policy Improvement2020/2/1
- Multiple Futures Prediction2019/11/1
- Search on the Replay Buffer: Bridging Planning and Reinforcement Learning2019/6/1
- Efficient Exploration via State Marginal Matching2019/6/1
- Embodied Multimodal Multitask Learning2019/2/1
- Gated Path Planning Networks2018/6/1
- Structured Control Nets for Deep Reinforcement Learning2018/2/1
- Global Pose Estimation with an Attention-based Recurrent Network2018/2/1
- Active Neural Localization2018/1/1
- Gated-Attention Architectures for Task-Oriented Language Grounding2017/6/1