Xiangyu Shi
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Talk2Escape: 対話による視覚言語ナビゲーションの閉ループ化視覚言語ナビゲーション2026/9/23
ナビゲーションエージェントの迷走を検知したら対話で修正指示を求める仕組みを提案し、シミュレータと実機で成功率と頑健性を向上させた。
- オープンソース自動運転システムの解析と、強化学習テストおよび大規模言語モデルを用いた学際的ハードウェアインザループ研究パラダイム自動運転2026/8/31
複数車両の実車実験、コード再利用、ソフトウェア・ハードウェア連携テストを統一的にレビュー可能な枠組みを提案し、Apollo-on-Hongqi EV環境で実証した。
- 領域到達からインスタンスレベルの接地へ:視覚と言語によるナビゲーションの改善VLA2026/7/1
VLNエージェントの最終位置の精度と対象物の可視性を評価する指標を導入し、最終段階のナビゲーションを改善するモジュールREALMを提案した。
- SpatialAnt: 能動的なシーン再構築と視覚的予測による自律ゼロショットロボットナビゲーションナビゲーション2026/3/1
ロボットが未知環境を事前探索して自己構築した不完全な3D再構築を用いて、ゼロショットで言語指示によるナビゲーションを実現するフレームワークを提案した。物理的接地によるスケール回復と視覚的予測による経路の反実仮想推論で性能を向上させた。
- SpatialNav: 空間シーングラフを活用したゼロショット視覚言語ナビゲーションナビゲーション2026/1/1
環境を事前探索して空間シーングラフを構築し、エージェント中心の地図と方位合わせした視覚表現、遠隔物体位置推定を組み合わせることで、ゼロショット視覚言語ナビゲーションの性能を大幅に向上させた。
- Fast-SmartWay: パノラマ不要のエンドツーエンドゼロショット視覚言語ナビゲーションVLA2025/11/1
正面のRGB-D画像3枚と言語指示のみからMLLMが直接行動を予測するゼロショットVLN-CEフレームワークを提案し、パノラマ観測とウェイポイント予測器を排除して遅延を大幅に削減した。
- 物体検出のための身体性ドメイン適応物体検出2025/6/1
家庭や実験室の動的な屋内環境で物体検出器を適応させるため、ソースデータ不要のドメイン適応手法を提案し、時系列クラスタリングやマルチスケール閾値融合、平均教師フレームワークを組み合わせた。
- SmartWay: ゼロショット視覚言語ナビゲーションのためのウェイポイント予測とバックトラッキングの強化VLA2025/3/1
連続環境での視覚言語ナビゲーションにおいて、改良されたウェイポイント予測器とMLLMベースのナビゲータを組み合わせ、履歴推論とバックトラッキングを可能にしたゼロショットフレームワークを提案。