Mohamad Al Mdfaa
収録論文 4本 ・ フィジカルAI/ロボット学習
VQA/ナビゲーション身体性質問応答ナビゲーションパノプティックマッピング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VL-MemKnG: 長時間の自己中心視点ナビゲーション軌跡に対する質問応答のための時空間知識グラフとハイブリッドメモリVQA/ナビゲーション2026/6/1
長時間の自己中心視点ビデオに対するナビゲーション関連の質問応答において、時空間知識グラフとセグメントレベルの文脈メモリを組み合わせたハイブリッドメモリフレームワークを提案し、検索精度を向上させた。
- 時空間知識グラフを永続的なシーン記憶として用いる身体性質問応答身体性質問応答2025/10/1
単眼の一人称視点動画から3D再構成なしに時空間知識グラフを構築し、質問時に生映像を再処理せず低遅延で応答する学習不要の身体性質問応答フレームワークVL-KnGを提案。
- EgoWalk:実環境におけるロボットナビゲーションのためのマルチモーダルデータセットナビゲーション2025/5/1
多様な屋内・屋外環境での人間のナビゲーションを50時間分収録し、自然言語ゴール注釈や走行可能領域セグメンテーションなどの付随データセットを自動生成するパイプラインを備えた、ロボットナビゲーション研究用の大規模マルチモーダルデータセットを提案した。
- 見えざるものを地図化する:基盤モデルを用いた動的ラベリングによる統合プロンプト可能パノプティックマッピングパノプティックマッピング2024/5/1
基盤モデルを活用し、オープンボキャブラリのラベルを統合カテゴリ構造と幾何サイズ事前分布で調整する動的記述子を導入し、追加学習なしで永続的かつプロンプト可能なパノプティックマップを構築する手法を提案。