Gaurav S. Sukhatme
収録論文 94本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 火星を走るための学習:オフワールドナビゲーションのための視覚マルチモーダル走行可能性推定走行可能性推定/オフロードナビゲーション2026/9/21
火星探査車パーサヴィアランスの500ソル・45kmの走行データセットを構築し、マルチモーダルな不確実性考慮型走行可能性推定手法を提案した。
- MA-LIPP: 異種ロボットチームのための協調的な負荷認識型情報経路計画群制御2026/9/18
サンプル収集ロボットと運搬ロボットが非同期の「デッドドロップ」で協力する負荷認識型情報経路計画を提案し、MIQP定式化とスケーラブルなLNSヒューリスティックで高精度に解く。
- EFLUX: エージェント型LLMによる弾力的なマルチロボット隊列ナビゲーションと適応群制御2026/7/1
閉塞環境で隊列を変形・再構成しながらナビゲーションするマルチロボットシステムを、LLMを用いて幾何学的に制御するフレームワークを提案した。
- 閉ループアフィン活性化編集によるマルチロボット行動の操縦群制御2026/6/1
凍結したポリシーの活性化を閉ループで編集し、追加学習なしでロボットの行動を操縦するフレームワークCLAEを提案。マルチクアッドローターのナビゲーションで、個体の速度制御や編隊維持、新規行動の生成を実証した。
- デュエット:効率的な教示による二台ロボットの協調理解群制御2026/6/1
二台のロボットが協調して作業するための学習フレームワークを提案。VR遠隔操作と人間同士の協調動作データを活用し、少ない実機データで高性能な協調ポリシーを学習する。
- HANDFUL: 資源を考慮した逐次把持条件付き器用操作器用操作2026/4/1
器用なロボットハンドで、最初の把持を維持しながら次の操作タスクを実行する逐次操作を学習するフレームワークを提案し、指の使用を資源とみなして資源を考慮した把持を探索する。
- 把持と非把持の同時操作:多段階器用タスクへの実用的アプローチマニピュレーション2026/3/1
物体把持と別物体への操作を同時に行う多段階タスクを、物体中心スキルに分解し、少数の実演から実機で学習・実行する手法DexMultiを提案。
- 負荷を考慮した情報収集経路計画と物理的サンプリング経路計画2026/3/1
サンプル収集による質量増加が移動コストに影響する状況を考慮した情報収集経路計画問題を新たに定義し、エネルギー予算制約下で訪問位置・順序・サンプル数を最適化するMIQPとして定式化した。
- GAMMS: グラフベースの敵対的マルチエージェントモデリングシミュレータ群制御2026/2/1
グラフで表現できる環境でのマルチエージェントシミュレーションを、軽量かつ拡張可能に実行できるオープンソースフレームワークGAMMSを提案。可視化や外部ツール連携を備え、LLMを含む多様なエージェントを扱える。
- LEARN: リソース制約下でのエンドツーエンド空中マルチロボットナビゲーション学習群制御2025/11/1
低解像度ToFセンサと軽量プランナ、注意機構付きRL方策を組み合わせ、ナノUAV群がオンボードで障害物環境を自律飛行できる軽量ナビゲーション手法を提案。
- Refinery: 接触の多いタスク向け能動的ファインチューニングと展開時最適化マニピュレーション2025/10/1
ベイズ最適化によるファインチューニングとGMMベースの初期化選択で、接触の多い組立タスクの成功率を91.51%まで向上させ、多部品の長期組立も可能にした。
- PIP-LLM: 自然言語を用いたマルチロボットチーム調整のためのPDDL-整数計画法とLLMの統合群制御2025/10/1
自然言語指令をチームレベルのPDDL計画とロボットレベルの整数計画に分離して解くことで、マルチロボットチームの協調計画を効率的に生成するフレームワークを提案。
- SPAR: 航空ロボティクス向けのLLMによるスケーラブルなPDDLドメイン生成自動計画2025/9/1
大規模言語モデルを用いて自然言語からUAVタスクのPDDLドメインを自動生成するフレームワークSPARを提案し、データセット構築と評価パイプラインを整備した。
- 潜在活性編集:安全なマルチロボットナビゲーションのための学習済みポリシーの推論時改良マルチロボットナビゲーション2025/9/1
学習済みポリシーの重みを変えずに、推論時に内部活性を編集して衝突回避を促す手法を提案し、マルチクアッドロータナビゲーションで衝突を約90%削減した。
- 巧みな手による幾何学を考慮した非把持プッシュ・プル操作の学習マニピュレーション2025/9/1
物体の形状を条件とした拡散モデルで巧みな多指ハンドの接触前姿勢を生成し、把持せずに押す・引く操作を実現する手法を提案した。
- 大規模言語モデルによるマルチロボットチームの構成調整群制御2025/7/1
自然言語のミッション記述をビヘイビアツリーと知識ベースを介してマルチロボット制御コードに変換するLAN2CBを提案し、シミュレーションと実環境で有効性を示した。
- データ拡張なしで視覚ベース強化学習をゼロショット汎化強化学習2024/10/1
視覚ベース強化学習において、連想記憶と潜在空間の disentanglement を組み合わせることで、データ拡張に頼らず未知環境へのゼロショット汎化を実現する手法 ALDA を提案した。
- WARPD: 世界モデル支援による反応型ポリシー拡散模倣学習2024/10/1
拡散モデルで軌道ではなくニューラルポリシーの重みを生成し、閉ループ制御を実現することで、長期的タスクや外乱に強く、推論コストを大幅に削減した手法。
- 未知の危険環境下におけるリアルタイムマルチロボット目標追跡のための階層型LLMインザループ最適化群制御2024/9/1
LLMを二層最適化の意思決定ループに組み込み、危険環境でのマルチロボット目標追跡をリアルタイムに適応させる枠組みを提案し、シミュレーションと実機で有効性を示した。
- センシング・通信危険地帯における耐故障マルチロボット目標追跡群制御2024/9/1
未知のセンシング・通信危険地帯で確率的・一時的な故障が起きる環境に対し、ソフトチャンス制約付き非線形最適化で追跡性能と耐故障性を動的に両立する協調枠組みを提案し、実機実験で検証した。
- AutoMate: 多様な形状に対応する専門家・汎用組み立てポリシーマニピュレーション2024/7/1
100種類の組み立てタスクのデータセットと並列シミュレーション環境を構築し、部品特化型と汎用型の組み立てポリシーを学習。シミュレーションから実機へのゼロショット転移を実現した。
- 逆リスク感度付きマルチロボットタスク割り当て群制御2024/6/1
人間の監督者が示すリスク感度に基づく割り当てを実現するため、現在のパラメータから最小限の変更で済む人間行動リスクモデルのパラメータを逆問題として求める新定式化IR-MRTAを提案し、非凸最適化問題であることを示した。
- 複雑環境における能動的信号エミッタ配置信号源配置2024/5/1
ロボットが信号源の配置と計測を交互に行い、因子グラフに基づく信念モデルで不確実性を考慮しながら配置を改善する手法を提案。
- SAFE-GIL: ロボットシステムのための安全誘導型模倣学習模倣学習2024/4/1
データ収集時に敵対的擾乱を注入して安全クリティカルな状況での専門家行動を学習させ、テスト時のポリシー誤りによる安全違反を減らす模倣学習手法を提案。
- センシング・通信危険領域を考慮したマルチロボット目標追跡群制御2024/4/1
複数ロボットによる目標追跡において、センシングや通信が妨害される危険領域を回避しつつ追跡するリスク認識型の枠組みを提案し、シミュレーションとドローン実験で検証した。
- 人間参加型マルチロボット情報収集のための逆部分モジュラー最大化群制御2024/3/1
人間の監督者が提案する経路に合わせてロボットの意思決定パラメータを最小限の変更で調整する逆部分モジュラー最大化問題を定式化し、単一提案の場合に混合整数二次計画問題として解く手法を提案した。
- 大規模言語モデルはロボットの経路計画を解けるか経路計画2024/3/1
自然言語で記述されたロボット経路計画問題をLLMに直接解かせ、自己デバッグや自己検証、数式・疑似コード・関連論文などの文脈付与が成功率と最適性ギャップに与える影響を80問のデータセットで体系的に評価した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Conditionally Combining Robot Skills using Large Language Models2023/10/1
- CppFlow: Generative Inverse Kinematics for Efficient and Robust Cartesian Path Planning2023/9/1
- Collision Avoidance and Navigation for a Quadrotor Swarm Using End-to-end Deep Reinforcement Learning2023/9/1
- HyperPPO: A scalable method for finding small policies for robotic control2023/9/1
- MRNAV: Multi-Robot Aware Planning and Control Stack for Collision and Deadlock-free Navigation in Cluttered Environments2023/8/1
- LEMMA: Learning Language-Conditioned Multi-Robot Manipulation2023/8/1
- DREAM: Decentralized Real-time Asynchronous Probabilistic Trajectory Planning for Collision-free Multi-Robot Navigation in Cluttered Environments2023/7/1
- QuadSwarm: A Modular Multi-Quadrotor Simulator for Deep Reinforcement Learning with Direct Thrust Control2023/6/1
- Granular Gym: High Performance Simulation for Robotic Tasks with Granular Materials2023/6/1
- IndustReal: Transferring Contact-Rich Assembly Tasks from Simulation to Reality2023/5/1
- Generating Behaviorally Diverse Policies with Latent Diffusion Models2023/5/1
- Reducing Network Load via Message Utility Estimation for Decentralized Multirobot Teams2023/4/1
- A Study on Multirobot Quantile Estimation in Natural Environments2023/3/1
- Learned Parameter Selection for Robotic Information Gathering2023/3/1
- Probabilistic Trajectory Planning for Static and Interaction-aware Dynamic Obstacle Avoidance2023/2/1
- RREx-BoT: Remote Referring Expressions with a Bag of Tricks2023/1/1
- Fast and Scalable Signal Inference for Active Robotic Source Seeking2023/1/1
- CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation2022/11/1
- Efficiently Learning Small Policies for Locomotion and Manipulation2022/10/1
- CH-MARL: A Multimodal Benchmark for Cooperative, Heterogeneous Multi-Agent Reinforcement Learning2022/8/1
- Decentralized Risk-Aware Tracking of Multiple Targets2022/8/1
- Learning Deformable Object Manipulation from Expert Demonstrations2022/7/1
- A Simple Approach for Visual Rearrangement: 3D Mapping and Semantic Search2022/6/1
- Loop Closure Prioritization for Efficient and Scalable Multi-Robot SLAM2022/5/1
- Inferring Articulated Rigid Body Dynamics from RGBD Video2022/3/1
- DialFRED: Dialogue-Enabled Agents for Embodied Instruction Following2022/2/1
- Informative Path Planning to Estimate Quantiles for Environmental Analysis2022/1/1
- Distilling Motion Planner Augmented Policies into Visual Control Policies for Robot Manipulation2021/11/1
- A Simple Approach to Continual Learning by Transferring Skill Parameters2021/10/1
- Beyond Robustness: A Taxonomy of Approaches towards Resilient Multi-Robot Systems2021/9/1
- Adaptive Sampling using POMDPs with Domain-Specific Considerations2021/9/1
- Probabilistic Inference of Simulation Parameters via Parallel Differentiable Simulation2021/9/1
- Decentralized Control of Quadrotor Swarms with End-to-end Deep Reinforcement Learning2021/9/1
- Adaptive and Risk-Aware Target Tracking with Heterogeneous Robot Teams2021/5/1
- Adaptive Sampling: Algorithmic vs. Human Waypoint Selection2021/4/1
- NeuralSim: Augmenting Differentiable Simulators with Neural Networks2020/11/1
- Motion Planner Augmented Reinforcement Learning for Robot Manipulation in Obstructed Environments2020/10/1
- Learning Equality Constraints for Motion Planning on Manifolds2020/9/1
- Resilient Monitoring in Heterogeneous Multi-robot Systems through Network Reconfiguration2020/8/1
- Augmenting Differentiable Simulators with Neural Networks to Close the Sim2Real Gap2020/7/1
- Supervised Learning and Reinforcement Learning of Feedback Models for Reactive Behaviors: Tactile Feedback Testbed2020/7/1
- Sampling-Based Motion Planning on Sequenced Manifolds2020/6/1
- Learning Manifolds for Sequential Motion Planning2020/6/1
- Confidence-rich grid mapping2020/6/1
- Resilience in multi-robot multi-target tracking with unknown number of targets through reconfiguration2020/4/1
- Plan-Space State Embeddings for Improved Reinforcement Learning2020/4/1
- Never Stop Learning: The Effectiveness of Fine-Tuning in Robotic Reinforcement Learning2020/4/1
- Experimental Comparison of Global Motion Planning Algorithms for Wheeled Mobile Robots2020/3/1
- Encoding Physical Constraints in Differentiable Newton-Euler Algorithm2020/1/1
- Automatic Differentiation and Continuous Sensitivity Analysis of Rigid Body Dynamics2020/1/1
- Physics-based Simulation of Continuous-Wave LIDAR for Localization, Calibration and Tracking2019/12/1
- Resilience in multi-robot target tracking through reconfiguration2019/10/1
- Resilient Coverage: Exploring the Local-to-Global Trade-off2019/10/1
- Interactive Differentiable Simulation2019/5/1
- Sim-to-(Multi)-Real: Transfer of Low-Level Robust Control Policies to Multiple Quadrotors2019/3/1
- Resilience by Reconfiguration: Exploiting Heterogeneity in Robot Teams2019/3/1
- Auto-conditioned Recurrent Mixture Density Networks for Learning Generalizable Robot Skills2018/10/1
- Planning Safe Paths through Hazardous Environments2018/3/1
- Downwash-Aware Trajectory Planning for Large Quadrotor Teams2017/4/1
- Data-Driven Learning and Planning for Environmental Sampling2017/2/1
- Designing Sparse Reliable Pose-Graph SLAM: A Graph-Theoretic Approach2016/11/1
- Informative Planning and Online Learning with Sparse Gaussian Processes2016/9/1
- A Solution to Time-Varying Markov Decision Processes2016/5/1
- Learning Relevant Features for Manipulation Skills using Meta-Level Priors2016/5/1
- Decentralized Data Fusion and Active Sensing with Mobile Sensors for Modeling and Predicting Spatiotemporal Traffic Phenomena2012/6/1
- Active Classification: Theory and Application to Underwater Inspection2011/6/1