Zixu Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAナビゲーション軌道予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Drive-P2D: 自動運転向けVLMのための段階的知覚から意思決定へのベンチマークVLA2026/1/1
自動運転における視覚言語モデル(VLM)を、物体・シーン・意思決定の3段階で評価する6,650問のベンチマークを提案し、推論と回答を分離して採点・誤り分析を行う。
- Open-Nav: オープンソースLLMによる連続環境でのゼロショット視覚言語ナビゲーションの探求VLA2024/9/1
オープンソースLLMを使い、連続環境でのゼロショット視覚言語ナビゲーションを実現するOpen-Navを提案。時空間Chain-of-Thought推論と詳細な物体・空間知識でシーン認識を強化し、閉源LLMに匹敵する性能を示した。
- CoNav: 人間中心の協調ナビゲーションのためのベンチマークナビゲーション2024/6/1
人間の活動を観察して意図を推論し、人間より先に目的地へナビゲートする協調ナビゲーション(CoNav)ベンチマークを提案。LLMベースの人間動作生成と意図認識エージェントを開発した。
- SemanticFormer: 知識グラフを用いた軌道予測のための全体論的・意味的交通シーン表現軌道予測2024/4/1
交通参加者や道路構造、標識などの意味関係を知識グラフで表現し、メタパスと注意機構を組み合わせてマルチモーダルな軌道予測を行う手法を提案。
- nuScenes Knowledge Graph -- A comprehensive semantic representation of traffic scenes for trajectory prediction2023/12/1