Wenguan Wang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA3D表現学習空中ナビゲーション自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット操作のための視覚言語行動モデルにおける二重潜在記憶VLA2026/7/1
視覚言語行動モデルに、過去の経験を潜在記憶トークンとして統合するフレームワークを導入し、長期依存タスクの性能を向上させた。
- 非位置合わせ多視点画像からの空間知能のための3D表現学習3D表現学習2026/4/12
本論文は、カメラ位置情報なしの多視点画像から3D表現を学習するフレームワークUniSplatを提案し、幾何・外観・意味の一貫性を高めるためのデュアルマスキング、粗密ガウススプラッティング、ポーズ条件付き再較正機構を導入した。
- 履歴強化型二段階Transformerによる空中視覚言語ナビゲーション空中ナビゲーション2025/12/1
大規模都市環境でのUAVナビゲーションにおいて、粗い目標位置予測と細かい視覚分析を組み合わせた二段階Transformerと履歴グリッドマップを提案し、CityNavデータセットで性能を向上させた。
- 自動運転のための世界モデルに関するサーベイ自動運転2025/1/1
自動運転における世界モデルの研究を、将来の物理世界の生成・エージェントの行動計画・予測と計画の相互作用の3層に分類して体系的にレビューした論文。
- ETPNav: Evolving Topological Planning for Vision-Language Navigation in Continuous Environments2023/4/1
- Lana: A Language-Capable Navigator for Instruction Following and Generation2023/3/1
- Collaborative Visual Navigation2021/7/1