Shuhao Ye
Zhejiang University
収録論文 5本 ・ フィジカルAI/ロボット学習
オドメトリ/多カメラナビゲーションポーズ推定セグメンテーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- StreamRig: リグ内幾何を活用したストリーミング多カメラオドメトリオドメトリ/多カメラ2026/9/30
凍結した多視点3D基盤モデル上に、キャリブレーション済みカメラリグの幾何を活かした因果的ストリーミングオドメトリを構築するフレームワークを提案。
- 連続環境における視覚言語ナビゲーションの閉ループ強化学習のためのマクロ行動に基づくトポロジカルグラフの再考ナビゲーション2026/9/3
VLN-CEタスクを階層的MDPとして再構成し、トポロジカルグラフ上のマクロ行動空間で強化学習を行うことで、サンプル効率と性能を向上させた。
- G2G: グループ内幾何を活用したグループ間ポーズ推定ポーズ推定2026/6/1
2つの画像グループ間の相対6自由度ポーズを推定する手法を提案。グループ内の既知の幾何情報を活用しつつ、基盤モデルは凍結したまま軽量なモジュールを追加して高精度を達成した。
- Fast-SegSim: ロボットシミュレーションのためのリアルタイムオープンボキャブラリセグメンテーションセグメンテーション2026/4/1
2Dガウススプラッティングに基づく高速なオープンボキャブラリセグメンテーション手法を提案し、40FPS以上のレンダリング速度を実現。ロボットシミュレーションでのセンサ入力や、下流タスクの教師データ生成に利用できる。
- ETP-R1: 強化学習ファインチューニングによるトポロジカル計画の進化 — 連続環境における視覚言語ナビゲーションVLA2025/12/1
連続環境での視覚言語ナビゲーション(VLN-CE)において、グラフベースのモデルに大規模データと強化学習ファインチューニングを適用し、R2R-CEで最先端性能を達成した研究。