Kai Sheng
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NavJev: 行動中心の視覚圧縮と識別的行動意味記憶による効率的な視覚言語ナビゲーションVLA2026/9/28
MLLMの逐次推論をやめ、候補行動を圧縮表現に変換して軽量な確率的行動選択を行うことで、視覚言語ナビゲーションの推論遅延を大幅に削減したフレームワーク。
- DPed-VLN:動的歩行者環境における社会的規範に沿った視覚言語ナビゲーションのベンチマークVLA2026/9/18
歩行者が動く環境での視覚言語ナビゲーションを評価するHabitat 3.0ベンチマークを構築し、歩行者を考慮した強化学習・模倣学習ポリシーDPetを提案した。
- 具現化視覚言語ナビゲーションの包括的サーベイと体系的実世界評価ナビゲーション2026/7/1
視覚と言語によるナビゲーション(VLN)の研究を体系的に分類し、物理ロボットでの実世界評価を行った。シミュレーションと実世界の性能差を明らかにし、階層的フレームワークの堅牢性を示した。
- P2DNav: パノラマから俯瞰への推論によるゼロショット視覚言語ナビゲーションナビゲーション2026/5/19
ゼロショットの視覚言語ナビゲーションにおいて、パノラマ方向選択と俯瞰ローカル接地を分離した階層的フレームワークを提案し、性能を向上させた。