Yuehao Huang
Zhejiang University
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAVLA/ナビゲーションナビゲーション全身マニピュレーションイベントカメラ/オドメトリ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RiverVLN: フェーズ接地型時間的視覚言語ナビゲーションによる無人水上艇の河川航行VLA2026/9/20
河川を航行する無人水上艇(USV)向けに、長期的な言語指示を視覚的に検証可能な意味フェーズ列に変換し、予測・実行・再観測ループで連続的なSE(2)姿勢増分を予測するナビゲーション手法PGT-NAVとベンチマークRiverVLNを提案した。
- WNM-3D: 3Dシーン条件付けによるクローズドループVLNのための世界ナビゲーションモデルVLA/ナビゲーション2026/8/7
連続的な視覚言語ナビゲーション(VLN)のための生成的世界行動モデルを提案し、3Dシーン表現を条件として将来の視覚と行動を同時生成することで、クローズドループのナビゲーション性能を向上させた。
- GN0: 視覚言語ナビゲーションにおける生成・評価・方策学習の統一的パラダイムに向けてナビゲーション2026/6/1
大規模データセットと高忠実度シミュレータを構築し、RL駆動のナビゲーション基盤モデルを提案して、視覚言語ナビゲーションの性能を向上させた。
- SAGE-Nav: LLM計画とアライメント融合を活用した階層的シーングラフ誘導ナビゲーションナビゲーション2026/6/1
LLMによる大域計画と階層的シーングラフ符号化、目標認識アライメント融合ネットワークを組み合わせ、物体目標ナビゲーションの性能と汎化性を向上させた。
- SimGenHOI: 生成モデルと強化学習による物理的にリアルな全身ヒューマノイド-物体インタラクション全身マニピュレーション2025/8/1
拡散トランスフォーマーでテキストと物体形状から全身動作を生成し、強化学習による接触考慮型制御で貫通や足滑りを補正することで、物理的に実現可能なヒューマノイドの物体操作を生成するフレームワーク。
- CogDDN: 認知的需求駆動ナビゲーションと二重プロセス思考による意思決定最適化ナビゲーション2025/7/1
VLMを用いて人間の速い思考と遅い思考を模倣し、未知環境で暗黙の要求に応じて対象物体を探索・ナビゲートするフレームワークを提案。
- 適応的減衰時間表面と極性認識トラッキングを用いた単眼イベント慣性オドメトリイベントカメラ/オドメトリ2024/9/1
イベントカメラの非同期イベントから適応的減衰カーネルベースの時間表面でテクスチャを抽出し、極性反転表面を併用したトラッキングで運動方向変化に頑健な単眼イベント慣性オドメトリを実現した。