Kumaraditya Gupta
収録論文 5本 ・ フィジカルAI/ロボット学習
環境認識VLA3Dシーン理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 半静的シーンに対する予測的時空間シーングラフ環境認識2026/5/1
時間変化する環境で物体の状態遷移を学習し、未来の状態を予測するためのベイズフィルタを組み込んだ3Dシーングラフ構造を提案した論文。
- エージェント的シーンポリシー:ロボット行動のための空間・意味・アフォーダンスの統合VLA2025/9/1
シーン表現をロボットと世界の問い合わせ可能なインターフェースとして用い、言語指示に基づく行動をゼロショットで計画するエージェントフレームワークASPを提案。
- OpenLex3D: オープンボキャブラリ3Dシーン表現のための階層的評価ベンチマーク3Dシーン理解2025/3/1
Replica、ScanNet++、HM3Dのシーンに同義語や詳細記述を含む新規ラベルを付与し、オープンボキャブラリ3Dシーン表現を評価するベンチマークを提案。既存手法の失敗事例や改善点を明らかにする。
- QueSTMaps: クエリ可能な意味トポロジカルマップによる3Dシーン理解3Dシーン理解2024/4/1
室内3Dシーンから間取り図(トポロジカルマップ)を抽出し、各部屋にCLIP特徴と意味ラベルを付与することで、自然言語クエリで部屋を特定できるようにした手法。
- 視覚言語ナビゲーションのためのオープンセット3D意味インスタンスマップVLA2024/4/1
基盤モデルを活用し、インスタンスレベルの埋め込みを持つ3D点群マップを構築することで、言語指示に基づくナビゲーションの成功率を向上させ、未知の物体も認識可能にした。