Sourav Garg
収録論文 35本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PixelLoop: ピクセルレベルループによるショートカット位相ナビゲーションナビゲーション2026/7/1
ピクセル空間でループ閉じを行い、密な位相的ショートカットを生成することで、任意点間ナビゲーションの成功率と経路効率を大幅に向上させる手法を提案した。
- SILICA: 拡散モデルの事前知識を再利用したガラス領域分割と深度推定の統合深度推定/セグメンテーション2026/7/1
テキストから画像を生成する拡散モデルの事前知識を活用し、ガラスの領域分割と深度推定を同時に行う統一パイプラインを提案。実世界のガラス深度アノテーションを不要とし、ゼロショットで未知環境に一般化できることを示した。
- MASt3R-Nav: 相対3DマップにおけるWayPixelナビゲーションナビゲーション2026/5/1
画像ペア間の相対3D座標系でのピクセル対応に基づくピクセル相対接続性マップを提案し、これをコストマップとして用いて制御器を訓練することで、高精度な視覚ナビゲーションを実現した。
- TANGO: 走行可能性を考慮した局所メトリック制御によるトポロジカルゴールへのナビゲーションナビゲーション2025/9/1
RGB画像のみを用い、3Dマップや学習済み制御器なしで物体レベルのサブゴールへ長距離ナビゲーションするトポメトリック手法を提案。単眼深度と走行可能性推定で局所軌道を予測し、基盤モデルによりゼロショットで未知環境に適用できる。
- ObjectReact: 物体相対制御を学習する視覚ナビゲーション視覚ナビゲーション2025/9/1
単眼カメラとトポロジカルマップを用いた視覚ナビゲーションにおいて、画像相対ではなく物体相対の制御を学習する新手法を提案し、センサ高さの変化に対する頑健性を示した。
- 10回のデモから学ぶ:指向性アフォーダンスフレームによる汎化可能でサンプル効率の良い方策学習模倣学習2024/10/1
指向性アフォーダンスフレームという構造化表現を用いて、わずか10回のデモから汎化性能の高いロボット方策を学習し、長期・複数物体タスクをサブ方策の合成で解決する手法を提案。
- 場所認識のための画像セグメント検索場所認識2024/9/1
画像全体ではなく意味的なセグメント単位で符号化・検索するSegVLADを提案し、視点変化に頑健な場所認識を実現した。
- RoboHop: セグメントベースのトポロジカルマップ表現によるオープンワールド視覚ナビゲーション視覚ナビゲーション2024/5/1
画像セグメントをノードとするトポロジカルグラフを構築し、自然言語クエリによる物体探索とセグメント間のホップとしてナビゲーション計画を生成する手法を提案。
- QueSTMaps: クエリ可能な意味トポロジカルマップによる3Dシーン理解3Dシーン理解2024/4/1
室内3Dシーンから間取り図(トポロジカルマップ)を抽出し、各部屋にCLIP特徴と意味ラベルを付与することで、自然言語クエリで部屋を特定できるようにした手法。
- DiffPrompter: Differentiable Implicit Visual Prompts for Semantic-Segmentation in Adverse Conditions2023/10/1
- Hierarchical Unsupervised Topological SLAM2023/10/1
- AnyLoc: Towards Universal Visual Place Recognition2023/8/1
- SayPlan: Grounding Large Language Models using 3D Scene Graphs for Scalable Robot Task Planning2023/7/1
- DisPlacing Objects: Improving Dynamic Vehicle Detection via Visual Place Recognition under Adverse Conditions2023/6/1
- Locking On: Leveraging Dynamic Vehicle-Imposed Motion Constraints to Improve Visual Localization2023/6/1
- Deep Declarative Dynamic Time Warping for End-to-End Learning of Alignment Paths2023/3/1
- GDIP: Gated Differentiable Image Processing for Object-Detection in Adverse Conditions2022/9/1
- When the Sun Goes Down: Repairing Photometric Losses for All-Day Depth Estimation2022/6/1
- Improving Worst Case Visual Localization Coverage via Place-specific Sub-selection in Multi-camera Systems2022/6/1
- ReF -- Rotation Equivariant Features for Local Feature Matching2022/3/1
- MultiRes-NetVLAD: Augmenting Place Recognition Training with Low-Resolution Imagery2022/2/1
- A Hierarchical Dual Model of Environment- and Place-Specific Utility for Visual Place Recognition2021/7/1
- SeqNetVLAD vs PointNetVLAD: Image Sequence vs 3D Point Clouds for Day-Night Place Recognition2021/6/1
- RoRD: Rotation-Robust Descriptors and Orthographic Views for Local Feature Matching2021/3/1
- Where is your place, Visual Place Recognition?2021/3/1
- SeqNet: Learning Descriptors for Sequence-based Hierarchical Place Recognition2021/2/1
- Semantics for Robotic Mapping, Perception and Interaction: A Survey2021/1/1
- Unsupervised Monocular Depth Estimation for Night-time Images using Adversarial Domain Feature Adaptation2020/10/1
- Delta Descriptors: Change-Based Place Representation for Robust Visual Localization2020/6/1
- Fast, Compact and Highly Scalable Visual Place Recognition through Sequence-based Matching of Overloaded Representations2020/1/1
- Look No Deeper: Recognizing Places from Opposing Viewpoints under Varying Scene Appearance using Single-View Depth Estimation2019/2/1
- OpenSeqSLAM2.0: An Open Source Toolbox for Visual Place Recognition Under Changing Conditions2018/4/1
- LoST? Appearance-Invariant Place Recognition for Opposite Viewpoints using Visual Semantics2018/4/1
- Don't Look Back: Robustifying Place Categorization for Viewpoint- and Condition-Invariant Place Recognition2018/1/1
- Improving Condition- and Environment-Invariant Place Recognition with Semantic Place Categorization2017/6/1