Laksh Nanwani
収録論文 5本 ・ フィジカルAI/ロボット学習
深度推定/セグメンテーション群集ナビゲーション群衆ナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SILICA: 拡散モデルの事前知識を再利用したガラス領域分割と深度推定の統合深度推定/セグメンテーション2026/7/1
テキストから画像を生成する拡散モデルの事前知識を活用し、ガラスの領域分割と深度推定を同時に行う統一パイプラインを提案。実世界のガラス深度アノテーションを不要とし、ゼロショットで未知環境に一般化できることを示した。
- Crowd-FM: 群集ナビゲーションのための条件付きフローマッチング生成軌道の学習に基づく最適選択群集ナビゲーション2026/2/1
条件付きフローマッチングで衝突回避軌道を生成し、人間らしさを評価するスコア関数で最適な軌道を選択する群集ナビゲーション手法を提案。
- CrowdSurfer: ベクトル量子化VAEとサンプリング最適化による密集群衆ナビゲーション群衆ナビゲーション2024/9/1
VQ-VAEで専門家軌道の事前分布を学習し、実行時にサンプリング最適化で洗練させることで、動的障害物の予測なしに密集群衆内の移動成功率を40%向上させた。
- 視覚言語ナビゲーションのためのオープンセット3D意味インスタンスマップVLA2024/4/1
基盤モデルを活用し、インスタンスレベルの埋め込みを持つ3D点群マップを構築することで、言語指示に基づくナビゲーションの成功率を向上させ、未知の物体も認識可能にした。
- Instance-Level Semantic Maps for Vision Language Navigation2023/5/1