Saurabh Gupta
収録論文 49本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自己実演生成制御によるVLAのファインチューニング:多タスク操作のための手法VLA/操作2026/8/19
新しいロボットにVLAモデルを展開する際の性能低下を防ぐため、ゼロショットVLAから生成したオンラインインタラクションロールアウトを追加学習データとして用いる自己教師ありファインチューニング手法を提案。
- 情報量を考慮したオドメトリと遡及的ループクロージャによるグラフベースLiDAR SLAMの地図整合性向上SLAM2026/7/1
LiDAR SLAMにおいて、軌道精度だけでなく再訪地点での地図の幾何的整合性を高めるため、ICPの情報行列を推定してオドメトリ制約を重み付けし、階層的かつ遡及的なループクロージャで見逃しを回復する手法を提案した。
- ContactMimic: 接触制御によるヒューマノイドの物体インタラクションヒューマノイド/接触制御2026/7/1
キーポイント追跡だけでは不十分な物体インタラクション(椅子に座る、黒板を拭くなど)に対し、接触コマンドを明示的に追跡する学習フレームワークを提案。接触追従報酬と軌道拡張により接触行動をキーポイント幾何から分離し、実世界で接触制御を実現した。
- 日常の人間ビデオを用いたロボット操作ポリシーの共学習で重要な要素は何か?操作学習2026/6/4
ロボット操作ポリシーの共学習に日常の人間ビデオを用いる際、手のポーズの品質とネットワークの専門化が重要であることを示し、低ロボットデータ環境で成功率を29.7%向上させるレシピを提案した。
- MoRight: モーション制御を正しく行う動画生成2026/4/1
ユーザー指定の動作で物体の動きを制御しつつ、カメラ視点も自由に変えられる動画生成フレームワークを提案。能動的動作と受動的反応を分離して因果関係を学習し、順方向・逆方向の推論を可能にした。
- 3D LiDAR SLAMにおける最大クリークを用いたループ閉じ込みSLAM2026/3/1
RANSACの代わりに、対応点の整合性グラフ上の最大クリーク探索でループ閉じ込みを検証する決定論的アルゴリズムCliRegを提案し、ノイズや外れ値に頑健で、実データで精度が向上することを示した。
- HERO: 視覚による全身オープンボキャブラリ物体把持のためのヒューマノイドエンドエフェクタ制御学習マニピュレーション2026/2/1
大規模視覚モデルとシミュレーション訓練を組み合わせ、残差を考慮したエンドエフェクタ追従ポリシーにより、ヒューマノイドが実環境で多様な物体を把持できるモジュール型システムを実現した。
- VisualSync: クロスビュー物体運動によるマルチカメラ同期マルチカメラ同期2025/12/1
複数の未同期・未校正カメラ映像から、共通して見える動物体のエピポーラ制約を利用してミリ秒精度で時間同期を取る最適化フレームワークを提案。
- KISS-SLAM: シンプルで堅牢かつ高精度な3D LiDAR SLAMシステムSLAM2025/3/1
LiDARのみを用いたSLAMにおいて「Keep It Small and Simple」の原則に基づき、追加センサや複雑な調整なしで高精度な自己位置推定と地図構築を実現するシステムを提案した。
- 小型物体の精密モバイルマニピュレーションマニピュレーション2025/2/1
視覚基盤モデルとビジュアルサーボを組み合わせ、エンドエフェクタの遮蔽をアウトペインティングで補正することで、未知環境での小型物体操作を高精度に実現する閉ループ手法SVMを提案。
- 実世界ヒューマノイドロボットのための起き上がり方策の学習歩行2025/2/1
二段階のカリキュラム学習により、人型ロボットが様々な地形で仰向け・うつ伏せから起き上がる制御器を獲得し、実機で実証した。
- 点群密度マップを用いたLiDAR SLAMの効率的なループ閉じ込めSLAM2025/1/1
LiDAR搭載ロボットのためのループ閉じ込め検出手法を提案し、様々なスキャンパターンや解像度に対応しながら、屋外SLAMの精度と長期局所化を向上させる。
- 連続時間軌道を活用した効率的なLiDARバンドル調整によるマルチスキャン位置合わせSLAM/点群位置合わせ2024/12/1
連続時間軌道を最小二乗調整に組み込み、対応探索の枝刈りとアウトオブコアバッファで数千点群を効率的に大域整合させる3D LiDARバンドル調整手法を提案。
- Lipschitz制約付きポリシーによる滑らかなヒューマノイド歩行の学習歩行2024/10/1
方策にLipschitz制約を勾配ペナルティとして課すことで、低域通過フィルタや平滑化報酬を使わずに滑らかで頑健なヒューマノイド歩行制御を学習する手法を提案し、実機で検証した。
- Kinematic-ICP: 平面移動する車輪型ロボットのための運動学的制約を導入したLiDARオドメトリLiDARオドメトリ2024/10/1
車輪型移動ロボットの運動学的制約をICP最適化に組み込み、LiDARと車輪オドメトリを動的に融合することで、倉庫などの平面環境での自己位置推定精度を向上させた。
- 未知のペイロードを持つ車輪型ヒューマノイドロボットの制御に向けて:Real-to-Sim適応による平衡点推定sim2real2024/3/1
未知の物体を持ち上げる車輪型脚ロボットの新しい平衡点を、実機データとシミュレーションを組み合わせて推定するフレームワークを提案し、車輪型倒立振子で有効性を検証した。
- 実世界で関節構造物を開けるモバイルマニピュレーションマニピュレーション2024/2/1
未知の関節構造物を開けるモバイルマニピュレーションを題材に、13箇所の実環境で100回以上の実験を行い、モジュール型が学習型より優れ、知覚が主なボトルネックであることを示した。
- 拡散モデルとDAggerの融合:ハンドアイ模倣学習の強化模倣学習2024/2/1
拡散モデルで失敗状態のデータを合成し、DAggerの高コストを回避して少ないデモからロバストなハンドアイ模倣学習を実現した。
- 3D Hand Pose Estimation in Everyday Egocentric Images2023/12/1
- GOAT: GO to Any Thing2023/11/1
- ContactGen: Generative Contact Modeling for Grasp Generation2023/10/1
- Online Learning-Based Inertial Parameter Identification of Unknown Object for Model-Based Control of Wheeled Humanoids2023/9/1
- Push Past Green: Learning to Look Behind Plant Foliage by Moving It2023/7/1
- Look Ma, No Hands! Agent-Environment Factorization of Egocentric Videos2023/5/1
- Predicting Motion Plans for Articulating Everyday Objects2023/3/1
- One-shot Visual Imitation via Attributed Waypoints and Demonstration Augmentation2023/2/1
- On-Device CPU Scheduling for Sense-React Systems2022/7/1
- Learning Value Functions from Undirected State-only Experience2022/4/1
- RB2: Robotic Manipulation Benchmarking with a Twist2022/3/1
- SEAL: Self-supervised Embodied Active Learning using Exploration and 3D Consistency2021/12/1
- Human Hands as Probes for Interactive Object Understanding2021/12/1
- Learned Visual Navigation for Under-Canopy Agricultural Robots2021/7/1
- Semantic Visual Navigation by Watching YouTube Videos2020/6/1
- Neural Topological SLAM for Visual Navigation2020/5/1
- Learning to Explore using Active Neural SLAM2020/4/1
- Use the Force, Luke! Learning to Predict Physical Forces by Simulating Effects2020/3/1
- Learning to Move with Affordance Maps2020/1/1
- DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning2019/11/1
- Efficient Bimanual Manipulation Using Learned Task Schemas2019/9/1
- PyRobot: An Open-source Robotics Framework for Research and Benchmarking2019/6/1
- Learning Navigation Subroutines from Egocentric Videos2019/5/1
- Learning Exploration Policies for Navigation2019/3/1
- Combining Optimal Control and Learning for Visual Navigation in Novel Environments2019/3/1
- Visual Memory for Robust Path Following2018/12/1
- Segmenting Unknown 3D Objects from Real Depth Images using Mask R-CNN Trained on Synthetic Data2018/9/1
- On Evaluation of Embodied Navigation Agents2018/7/1
- Unifying Map and Landmark Based Representations for Visual Navigation2017/12/1
- Cognitive Mapping and Planning for Visual Navigation2017/2/1
- Learning Rich Features from RGB-D Images for Object Detection and Segmentation2014/7/1