Wenxuan Guo
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AwareVLN: 自己認識による視覚言語ナビゲーションの推論VLA2026/5/1
視覚と言語によるナビゲーションにおいて、エージェントの状態とタスクの進捗を理解する自己認識推論機構を導入し、エンドツーエンドで高性能なナビゲーションを実現した。
- ジェスチャー対応視覚言語行動モデルGesVLA:埋め込み表現による操作精度の向上VLA2026/5/1
テキスト指示だけでは曖昧な空間指示を解決するため、ジェスチャーを並列指示として取り入れ、潜在空間に直接エンコードする視覚言語行動モデルGesVLAを提案した。実世界のロボット操作タスクで、複雑な環境での目標把握精度と対話効率が向上することを示した。
- GC-VLN: グラフ制約としての指示による学習不要の視覚言語ナビゲーションVLA2025/9/1
人間の指示を空間制約の有向非巡回グラフに分解し、制約ソルバで経路を解くことで、学習なしに連続環境でロボットをナビゲートするフレームワークを提案した。
- IGL-Nav: 画像ゴールナビゲーションのためのインクリメンタル3Dガウシアンローカリゼーションナビゲーション2025/8/1
3Dガウシアンスプラッティングを用いて、探索中に逐次更新されるシーン表現からゴール画像の位置を粗く特定し、近づくと微分可能レンダリングで精密化する画像ゴールナビゲーション手法を提案。