Wanzeng Kong
収録論文 7本 ・ フィジカルAI/ロボット学習
位置認識視覚的位置認識視覚オドメトリ3Dシーン表現SLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MAG-VLAQ: マルチモーダル航空・地上クエリ集約によるクロスビュー位置認識位置認識2026/5/1
地上画像とLiDAR、航空画像を統合し、ODEベースの融合とVLAQを用いてクロスビュー位置認識の精度を大幅に向上させた。
- DC-VLAQ: クエリ残差集約によるロバストな視覚的位置認識視覚的位置認識2026/1/1
DINOv2とCLIPの相補的特徴を残差補正で融合し、クエリへの残差応答で局所トークンを集約する視覚的位置認識フレームワークを提案。
- キーフレームベースのフィードフォワード視覚オドメトリ視覚オドメトリ2026/1/1
視覚基盤モデルを用いた視覚オドメトリに強化学習で適応的にキーフレームを選択する手法を導入し、計算効率と精度を向上させた。
- CUS-GS: マルチモーダルシーン表現のためのコンパクト統合構造化ガウシアンスプラッティングフレームワーク3Dシーン表現2025/11/1
複数の基盤モデルから得たマルチモーダル特徴をボクセルアンカー構造に統合し、外観・幾何・意味を一貫して表現する軽量な3Dガウシアンスプラッティング手法を提案。
- SLC²-SLAM: 共有潜在コードを用いた意味誘導ループ閉じ込みによるNeRF SLAMSLAM2025/1/1
NeRF SLAMで蓄積するドリフト誤差を抑えるため、再構成に使われる潜在コードを局所特徴として再利用し、意味情報で集約してループ検出を行う手法を提案した。
- VIPeR: 適応的マイニングと継続学習による視覚的インクリメンタル位置認識位置認識2024/7/1
新しい環境に適応しつつ過去の環境での性能を維持する視覚的位置認識手法VIPeRを提案。人間の記憶システムに着想を得た記憶バンクと確率的知識蒸留で破滅的忘却を防ぐ。
- AEGIS-Net: Attention-guided Multi-Level Feature Aggregation for Indoor Place Recognition2023/12/1