Qi Dai
収録論文 5本 ・ フィジカルAI/ロボット学習
視覚ナビゲーションナビゲーション対UAVVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚ナビゲーションのための言語条件付きワールドモデリング視覚ナビゲーション2026/3/1
言語指示に基づく視覚ナビゲーションを、初期の一人称視点のみから将来の軌道を予測する問題として定式化し、大規模データセットと2つのモデル群を提案した。
- 記憶拡張型の計画と予見による視覚ナビゲーションのための統合世界モデルに向けてナビゲーション2025/10/1
視覚的予見と計画を単一のマルチモーダル自己回帰バックボーンに統合し、階層的記憶機構で長期推論を安定化させた世界モデルUniWMを提案。4つのベンチマークでナビゲーション成功率を最大30%改善し、未見環境へのゼロショット汎化も示した。
- 空の安全保障:対UAV手法、ベンチマーク、今後の方向性に関する包括的サーベイ対UAV2025/4/1
UAVの脅威に対抗するための分類・検出・追跡技術を、拡散モデルやマルチモーダル融合などの新手法を含めて体系的に調査し、課題と将来展望をまとめたサーベイ論文。
- HA-VLN 2.0:動的な複数人環境における人間認識ナビゲーションのためのオープンベンチマークとリーダーボードVLA2025/3/1
離散・連続空間での人間認識型視覚言語ナビゲーションを統一評価するベンチマークを提案し、社会的制約を考慮したデータセット・シミュレータ・実機検証・リーダーボードを公開した。
- 人間を考慮した視覚言語ナビゲーション:動的な人間活動を組み込んだシミュレーションから現実への橋渡しVLA2024/6/1
動的な人間活動を取り入れたHA-VLNタスクを提案し、HA3DシミュレータとHA-R2Rデータセット、および2種類のエージェントを構築して、人間がいる環境でのナビゲーション性能を評価した。