Yiyuan Pan
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLESA: 人間活動監視のための視覚言語身体化安全エージェント安全性/行動予測2026/6/2
一人称視点映像から人間の活動を監視し、危険な行動を予測してリアルタイムに安全介入を行うフレームワークを提案。意図に応じて安全性が変わる行動を扱うため、目標条件付き安全Qフィルタを導入した。
- 物理的整合性を考慮したタスク構造再構成による推論時ロボット行動制御ロボット制御2026/6/1
学習済みロボットポリシーを再学習せずに、テスト時にユーザーの好みへ行動を誘導する手法ReStructを提案。ニューラルオートマトンでタスク構造を再構成し、物理的に実現可能な制御を実現する。
- G2G: グループ内幾何を活用したグループ間ポーズ推定ポーズ推定2026/6/1
2つの画像グループ間の相対6自由度ポーズを推定する手法を提案。グループ内の既知の幾何情報を活用しつつ、基盤モデルは凍結したまま軽量なモジュールを追加して高精度を達成した。
- ヒューマノイドロボットの安全停止可能性モニタの学習ヒューマノイド安全制御2026/3/1
ヒューマノイドロボットの緊急停止を安全に行える状態範囲を、データ駆動で学習するフレームワークPRISMを提案し、シミュレーションから実機への適用も実証した。
- 創発的ニューラルオートマトンポリシー:視覚運動軌跡からの記号構造学習長期的タスク学習2026/3/1
視覚運動デモから適応的クラスタリングとL*アルゴリズムの拡張でMealy状態機械を推定し、高レベルプランナーとして利用。離散構造が低レベル残差ネットワークを導き、長期的タスクで高効率・解釈可能なポリシーを実現する。
- 夢から想起へ:想像誘導型経験検索による記憶持続型視覚言語ナビゲーションVLA2025/10/1
世界モデルが将来のナビゲーション状態を想像して検索クエリとし、視点に紐づけた観察と行動パターンの記憶から関連経験を選択的に引き出す記憶持続型VLN手法を提案。
- 不確実性を見通す:視覚ナビゲーションにおけるロバストなタスク指向最適化視覚ナビゲーション2025/10/1
視覚ナビゲーションでデータ不足時に生じる知覚の不確実性を凸集合としてモデル化し、ロバスト最適化と統合することで未知環境への汎化性能を高める学習フレームワークNeuROを提案した。
- 好奇心は道を開く:マルチエージェント文脈校正による好奇心駆動型探索マルチエージェント強化学習2025/9/1
マルチエージェント強化学習において、仲間の行動から文脈を推論して好奇心を動的に校正し、ノイズを除去して効率的な探索を実現する手法CERMICを提案。
- マルチカメラ・マルチマップ視覚慣性自己位置推定:システム、検証、データセットVLA2024/12/1
因果的なリアルタイム自己位置推定を実現するマルチカメラ・マルチマップ視覚慣性システムを提案し、評価指標と長期キャンパスデータセットを構築して有効性を示した。
- 想像による計画:視覚と言語によるナビゲーションのためのエピソード的シミュレーションとエピソード的記憶VLA2024/12/1
人間のエピソード的シミュレーションと記憶に着想を得て、エージェントが未来のシーンを想像しながら記憶を拡張するVLNアーキテクチャを提案し、SPLで最先端を達成した。
- FLAME: 都市環境におけるマルチモーダルLLMによるナビゲーション学習VLA2024/8/1
都市の視覚言語ナビゲーション向けに、3段階のチューニングでマルチモーダルLLMを適応させるエージェントFLAMEを提案し、Touchdownデータセットでタスク完了率を7.3%向上させた。
- CORAL: Colored structural representation for bi-modal place recognition2020/11/1