Yao He
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間らしい物理的知能に向けて:ロボット操作のための生涯視覚言語行動学習VLA/生涯学習2026/7/1
ロボット操作におけるVLAモデルの生涯学習を実現するため、二重タイムスケール適応機構とキャッシュ効率的なリプレイ戦略を備えたLifelongVLAフレームワークを提案した。
- オープンワールドロボット操作のための継続的手眼較正キャリブレーション/継続学習2026/4/1
ロボット操作における手眼較正の継続学習フレームワークを提案し、空間的リプレイ戦略と構造保存蒸留により、逐次的に遭遇する新しいシーンへの適応時の破滅的忘却を軽減する。
- RoboSenseチャレンジ:あらゆる環境を認識し、どこへでも移動し、プラットフォームを超えて適応するロボット知覚ベンチマーク2026/1/1
ロボット知覚の堅牢性と適応性を競うRoboSense 2025チャレンジの報告で、5つのタスクのベンチマークと23の受賞解法から得られた知見をまとめた。
- 足に頼らないロコモーション歩行2026/1/1
人型ロボットが手や膝、肘も使って複雑な地形を移動する全身運動システムを、物理ベースのキーフレームアニメーションと強化学習を組み合わせて実現した。
- PixelVLA:視覚言語行動モデルにおけるピクセルレベル理解の推進VLA2025/11/1
ピクセル単位のシーン理解とテキスト・画像のマルチモーダル指示に対応したVLAモデルを提案し、大規模ピクセル注釈データセットで学習することで、低コストながら操作成功率を大幅に向上させた。
- ロボットがロボットを訓練:ヒューマノイドのための実世界ポリシー自動適応と学習sim2real2025/8/1
ロボットアームの教師がヒューマノイドの生徒を保護・誘導しながら、実世界で効率的に強化学習を行うフレームワークを提案し、歩行速度追従や起き上がり動作で有効性を示した。
- ViSafe: 高速衝突回避のための視覚ベース安全システムの実証衝突回避2025/5/1
視覚のみで動作する高速空中衝突回避システムViSafeを提案し、学習ベースのエッジAIと制御バリア関数を組み合わせて、時速144kmの実機テストで安全性を実証した。
- MCVO: 任意配置マルチカメラ向け汎用ビジュアルオドメトリビジュアルSLAM2024/12/1
剛体結合された任意配置のマルチカメラ向けに、学習ベースの特徴追跡とメートルスケール初期化、バックエンド融合により高精度な姿勢推定を実現するビジュアルオドメトリを提案した。
- Stem-OB: 拡散逆変換による幹状収束観測を用いた汎化可能な視覚模倣学習模倣学習2024/11/1
事前学習済み拡散モデルの逆変換で観測画像から照明やテクスチャの違いを除去し、追加学習なしで視覚模倣学習の汎化性能を高めるプラグアンドプレイ手法を提案した。
- FIReStereo: 視界不良環境におけるUAS深度知覚のための森林赤外ステレオデータセットステレオ深度推定2024/9/1
煙・雨・夜間など視界が悪い環境でも使えるよう、熱赤外ステレオカメラとLiDAR・IMUで都市・森林を撮影した大規模データセットを構築し、代表的なステレオ深度推定手法を評価した。
- ロボットマニピュレーションのための終わりなき行動クローニングエージェントマニピュレーション2024/3/1
言語条件付きで新たな3Dシーン意味論と操作スキルを継続的に学習する終わりなき行動クローニングエージェントNBAgentを提案し、ベンチマークで有効性を示した。
- FoundLoc: Vision-based Onboard Aerial Localization in the Wild2023/10/1
- Toward Efficient and Robust Multiple Camera Visual-inertial Odometry2021/9/1