Muhammad Ahsan Mustafa
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AgenticSwarm: 異種マルチUAVミッションのための意味的知覚と適応的タスク割り当て群制御2026/9/18
航空画像と言語指示からミッション表現を構築し、制約付きタスク割り当てと障害発生時の再計画を統合したマルチUAVエージェントフレームワークを提案。
- AgenticDiffusion: 視覚ベースUAVナビゲーションのためのエージェント型拡散経路計画ナビゲーション2026/6/1
言語指示と複数視点(前方視点と俯瞰視点)を組み合わせ、拡散モデルによる経路計画とNMPCを統合した屋内UAVナビゲーションフレームワークを提案。実環境で80%の成功率を達成。
- AgenticRL: 視覚条件付きUAVナビゲーションのための自己改善型エージェント強化学習強化学習/UAVナビゲーション2026/6/1
報酬設計とポリシー改善を大規模言語モデルエージェントが自動で行う、UAVナビゲーションのための強化学習フレームワークを提案した。
- ImpedanceDiffusion: 拡散モデルによるUAV群ナビゲーションのための大域経路計画と生成的インピーダンス制御群制御2026/3/1
RGB画像から拡散モデルでUAV群の大域軌道を生成し、APF追従とVLM-RAGによる意味的インピーダンス制御を組み合わせて、混雑環境での安全な飛行とsim-to-real展開を実現した。
- HoverAI:自然な人とドローンのインタラクションを実現する身体性を備えた空中エージェント空中ロボット/対話AI2026/1/1
ドローンにレーザープロジェクタや会話AIを搭載し、音声・視覚で人を認識してリップシンク付きアバターで応答する、空間認識型の対話エージェントを開発した。
- Glove2UAV: 直感的なUAV操作のためのウェアラブルIMUグローブウェアラブル操作インターフェース2026/1/1
手と指のジェスチャーでUAVを直感的に操作するIMUグローブを開発し、速度閾値超過時に振動触覚警告を提示する。シミュレーションと実機飛行でリアルタイム性とコマンド実行の安定性を検証した。
- NMPC-Lander: 移動プラットフォームへのUAV着陸のためのバリア関数付き非線形MPCUAV着陸/非線形MPC2025/5/1
非線形モデル予測制御(NMPC)と制御バリア関数(CBF)を組み合わせ、静的・動的なプラットフォームへの安全で高精度な自律着陸を実現する制御アーキテクチャを提案し、実機実験で有効性を示した。
- UAV-CodeAgents: マルチエージェントReActと視覚言語推論によるスケーラブルなUAVミッション計画VLA2025/5/1
LLM/VLMを活用したマルチエージェントフレームワークで、衛星画像と自然言語指示からUAVのミッションを自動生成し、火災検知タスクで93%の成功率を達成した。
- UAV-VLRR: 視覚言語情報を用いたNMPCによるUAV捜索救助の迅速応答VLA2025/3/1
視覚言語モデルとLLMでシーンを解釈し、障害物回避機能付き非線形モデル予測制御でドローンを飛行させる捜索救助システムを開発し、既存の自動操縦や人間のパイロットより高速な応答を実現した。
- UAV-VLPA*:大規模環境での最適経路生成のための視覚・言語・経路・行動システム経路計画2025/3/1
衛星画像と視覚言語モデル、GPTの自然言語処理を組み合わせ、テキスト指示から飛行計画を生成するUAVシステムを提案。TSP最適化とA*による障害物回避で経路長を18.5%削減した。
- UAV-VLA:大規模航空ミッション生成のための視覚言語行動システムVLA2025/1/1
衛星画像とVLM・GPTを組み合わせ、テキスト指示から飛行経路と行動計画を生成するUAV向けシステムを提案。
- FlightAR: 複数映像ストリームと物体検出を統合した没入型ドローン操縦支援ARインターフェースヒューマンドローンインタラクション2024/10/1
ドローンのFPVカメラと底面カメラ映像をARでHMDに重畳表示し、周囲状況の把握と直感的操縦を支援するインターフェースを開発、FPVゴーグルより高いユーザ評価を得た。
- MorphoMove: 多肢形態形成型UAVのためのMPCベース経路追従を備えたバイモーダル経路プランナ経路計画/歩行2024/7/1
飛行と地上歩行の両方が可能な多肢形態形成型ドローンMorphoGearに対し、A*ベースのハイブリッド経路計画とMPCによる歩行経路追従を開発し、Unityシミュレーションで検証した。