Nader Zantout
収録論文 4本 ・ フィジカルAI/ロボット学習
SLAM/ナビゲーション3DグラウンディングVLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SuperMap: 視覚言語ナビゲーションのための時空間SLAMシステムSLAM/ナビゲーション2026/8/24
高頻度の幾何SLAMと非同期のオープンボキャブラリ知覚を統合し、物体の同一性維持と古い地図情報の整理を行う4D時空間マッピングフレームワークを提案。
- SORT3D: 大規模言語モデルを用いたゼロショット3Dグラウンディングのための空間オブジェクト中心推論ツールボックス3Dグラウンディング2025/4/1
2Dの物体属性とヒューリスティックな空間推論ツールボックスをLLMの逐次推論能力と組み合わせ、テキスト-3Dデータなしで未知環境にゼロショット適用できる3Dグラウンディング手法を提案。
- IRef-VLA: 不完全な言語指示を用いた3Dシーンにおける対話的参照グラウンディングのベンチマークVLA2025/3/1
不完全・曖昧な自然言語指示で3D屋内をナビゲートするタスク向けに、11.5Kの3Dスキャン部屋と470万件の参照文を含む大規模ベンチマークデータセットを構築し、既存モデルの性能評価基盤を提供した。
- VLA-3D: 3D意味理解とナビゲーションのための大規模データセットナビゲーション2024/11/1
屋内3Dシーンにおける言語指示ナビゲーション向けに、11.5K以上のスキャン済み部屋、2350万の物体間意味関係、970万の参照文を含む最大規模の実世界データセットを構築し、最先端モデルのベースライン性能を評価した。