Bingxi Liu
収録論文 3本 ・ フィジカルAI/ロボット学習
ナビゲーションVPR
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HAM-VLN: 階層的エージェント記憶を活用したゼロショット視覚言語ナビゲーションナビゲーション2026/7/1
ロボットが未知環境で指示に従って移動する際、画像や地図の代わりにエージェント自身が書き込む永続的な世界グラフを記憶として使い、次の行動選択と同じLLM呼び出しで記憶も更新することで、長期的なナビゲーションの記憶・推論ボトルネックを解消した。追加のLLM呼び出しなしで文脈長を65%以上削減しつつ、複数のナビゲーションベンチマークで最高性能を達成した。
- ImagineUAV: 世界モデルと運動力学的計画による空中視覚言語ナビゲーションナビゲーション2026/6/1
UAVの視覚言語ナビゲーションにおいて、潜在ビデオ拡散モデルで未来の観測を想像し、そこから6自由度の動作を抽出して衝突回避軌道を計画するフレームワークを提案。
- TextInPlace: シーンテキスト検出と検証による反復構造屋内環境での視覚的位置認識VPR2025/3/1
屋内環境に頻出する看板や標識などのテキストを検出・認識し、その類似度で画像検索結果を再ランク付けすることで、反復構造の多い屋内での視覚的位置認識精度を向上させる手法を提案。