Mobin Habibpour
収録論文 5本 ・ フィジカルAI/ロボット学習
VQA/ベンチマークVLAナビゲーションVisual SLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlameVQA: 放射温度計測による物理基盤のUAV山火事VQAベンチマークVQA/ベンチマーク2026/6/1
UAVによる山火事監視のための、RGB画像と放射温度画像を組み合わせた多肢選択式VQAベンチマークを構築し、代表的なMLLMの性能を評価した。
- FIRE-VLM:物理ベース火災デジタルツインにおけるUAV山火事追跡のための視覚言語駆動強化学習フレームワークVLA2026/1/1
高忠実度の山火事デジタルツイン内で、視覚言語モデル(VLM)の意味的報酬整形を用いてUAVの強化学習を行い、火災検出時間を最大6倍短縮した。
- 考え、記憶し、ナビゲートする:VLM推論によるゼロショット物体目標ナビゲーションナビゲーション2025/11/1
VLMをナビゲーションの能動的な戦略立案者として活用し、構造化された思考連鎖プロンプトと行動履歴・障害物マップの解釈により、ゼロショット物体目標ナビゲーションの効率を大幅に向上させた。
- RSV-SLAM: 屋内動的環境におけるリアルタイム意味論的Visual SLAMVisual SLAM2025/10/1
深層学習による意味情報と拡張カルマンフィルタを組み合わせ、動的物体を検出・除去して静的マップを維持するRGB-D SLAMを提案。TUMデータセットでリアルタイム動作を実現。
- 履歴拡張型視覚言語モデルによるフロンティアベースのゼロショット物体ナビゲーションナビゲーション2025/6/1
VLMに行動履歴を与えて動的にプロンプトし、フロンティア探索の意味的誘導と経路生成を行うゼロショット物体ナビゲーション手法を提案。HM3DでSR46%を達成。