Hanjing Ye
Southern University of Science and Technology
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 実世界動画からのスケーラブル学習による都市ナビゲーションのロングテール顕在化ナビゲーション2026/8/17
ウェブ上の未編集な一人称視点動画からメトリック軌跡とナビゲーション意味情報を自動アノテーションし、視覚言語行動ポリシーを訓練して都市ナビゲーションのロングテールな稀なシナリオを体系的に明らかにする枠組みを提案した。
- ReferTrack: 参照してから追跡する身体化視覚追跡手法視覚追跡2026/7/1
身体化視覚追跡において、自然言語で指定された対象をまず画像中のバウンディングボックスから選択し、その選択に基づいて追跡経路を生成する「参照→追跡」パラダイムを提案。時間的な対象情報を保持する工夫と参照QA学習により、単眼カメラで高い追跡成功率を達成し、実ロボットでも有効性を確認した。
- 単一視点メッシュ再構成はロボットカメラの回転に汎化できるか?3D再構成2026/6/1
ロボット搭載カメラの回転が単一視点メッシュ再構成の性能に与える影響を評価し、回転による深度推定の歪みやレイアウトずれを明らかにした。重力情報を活用した改良によりレイアウト誤差を47.1%削減できることを示した。
- 意図を考慮したシーン表現による群衆中のロボット視覚ナビゲーション学習ナビゲーション2026/6/1
群衆中のロボットナビゲーションにおいて、人間の意図と環境構造を考慮した視覚表現を用いた強化学習手法を提案し、シミュレーションと実環境で優れた性能を示した。
- NavIsaacLab: 並列ロボット学習による現実的な群衆生成と人間を考慮したナビゲーションのベンチマーキングナビゲーション2026/6/1
物理ベースで写実的なシミュレーション環境を提供し、データ駆動の歩行者モデルを用いて人間らしい群衆を生成することで、人間を考慮したナビゲーションポリシーの訓練と評価を可能にするフレームワークを提案した。
- TARIC: 遮断された意味的手がかり下でのメモリ拡張型・走行可能性認識屋外視覚言語ナビゲーションナビゲーション2026/5/1
屋外視覚言語ナビゲーションにおいて、意味的手がかりが途切れる状況でも、走行可能性を考慮した実行可能なガイダンスを維持する統合フレームワークを提案。3Dキューメモリと不確実性を考慮した読み出し機構により、長期的な手がかり欠如フェーズでも安定したナビゲーションを実現する。
- MfNeuPAN: 多フレーム点制約による動的環境での先読み型エンドツーエンドナビゲーションナビゲーション2025/11/1
移動障害物の将来経路を予測するモジュールを組み込み、現在と未来の多フレーム点制約を用いて動的環境で先回りして障害物を回避するエンドツーエンドナビゲーション手法を提案した。
- Adap-RPF: 動的混雑環境におけるロボット人物追従のための適応的軌道サンプリング人物追従2025/10/1
混雑環境での人物追従のため、社会的に配慮した領域で密な候補点を生成し多目的コストで評価する適応的軌道サンプリングと、歩行者予測を考慮したMPPI制御器を提案した。
- TrackVLA++:具現化視覚追跡のための推論と記憶能力を引き出すVLAモデルVLA2025/10/1
移動する対象を追跡する具現化視覚追跡において、空間推論と長期記憶のモジュールを導入し、遮蔽や類似物体に強いVLAモデルを提案した。
- EZREAL: 視界変動下で遠方目標へ向かうゼロショット屋外ロボットナビゲーションの強化ナビゲーション2025/9/1
遠方で小さく映る目標や一時的な遮蔽に対応するため、マルチスケール画像タイル階層と顕著性融合を用いた軽量なゼロショット物体ナビゲーションシステムを提案し、実環境で成功率を向上させた。
- Follow-Bench:社会的配慮を伴うロボット追従のための統合動作計画ベンチマーク動作計画2025/9/1
ロボットが人を追従する際の安全性と快適性を評価するため、多様なシナリオを再現する統一ベンチマークFollow-Benchを提案し、代表的な8手法を再実装して比較した。
- Meta-Memory: ロボットの空間推論のための意味・空間記憶の検索と統合空間推論2025/9/1
LLM駆動エージェントが環境の高密度記憶を構築し、自然言語の位置質問に対して意味と空間の記憶を統合して応答する手法を提案。SpaceLocQAデータセットを導入し、実機でも検証した。
- TPT-Bench:混雑環境での目標人物追跡をベンチマークする大規模長期ロボット視点データセット目標人物追跡2025/5/1
ロボット視点で混雑した屋内・屋外環境の目標人物を長期的に追跡するための大規模マルチモーダルデータセットを構築し、既存手法の性能を評価した。
- カメラ自己運動下での単眼人物位置推定人物位置推定2025/3/1
移動する単眼カメラから人物の3D位置を推定するため、4点モデルでカメラ姿勢と人物位置を同時最適化する手法を提案し、四足歩行ロボットの追従システムに実装した。
- FlowPlan: LLMフローエンジニアリングによるロボット指示追従のゼロショットタスク計画タスク計画2025/3/1
LLMを多段階ワークフローで活用し、ラベル付きデータなしでロボットの指示追従タスクを計画するゼロショット手法を提案。ALFREDベンチマークと実環境でデータ駆動型手法に匹敵する性能を示した。
- RPF-Search: 未知の動的環境におけるロボット人物追従のための場ベース探索人物追従2025/3/1
未知の動的環境で人物追従ロボットが遮蔽物により目標を見失う問題に対し、地形遮蔽と動的遮蔽に別々に対処するヒューリスティック探索フレームワークを提案し、シミュレーションと実機で探索効率と成功率を向上させた。
- GV-Bench:長期ループ閉じ込め検出の幾何検証のための局所特徴マッチングベンチマークSLAM2024/7/1
長期にわたる環境変化下でのループ閉じ込め検出の幾何検証に焦点を当てた統一ベンチマークを提案し、6つの代表的な局所特徴マッチング手法を評価した。
- HPPS: 空港での荷物カート検出・位置推定のための階層的漸進的知覚システム検出・位置推定2024/5/1
空港で荷物カートを回収するロボット向けに、一部が隠れていてもRGB画像だけでカートの位置と向きを高精度に検出・推定する階層的知覚システムを提案した。
- 部分観測下における人間の向き推定人物追従2024/4/1
単眼画像から人の向きを推定する際、体の一部しか見えない場合でも可視関節を活用し、信頼度を考慮して精度よく推定する手法を提案。ロボットの人物追従タスクの安定性向上も実証した。
- Person Re-Identification for Robot Person Following with Online Continual Learning2023/9/1
- Robot Person Following Under Partial Occlusion2023/2/1
- Mapping While Following: 2D LiDAR SLAM in Indoor Dynamic Environments with a Person Tracker2022/4/1
- Condition-Invariant and Compact Visual Place Description by Convolutional Autoencoder2022/4/1
- Following Closely: A Robust Monocular Person Following System for Mobile Robot2022/4/1