Hongpeng Cao
収録論文 9本 ・ フィジカルAI/ロボット学習
sim2real安全強化学習歩行経路計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LyEvO: リアプノフ誘導進化最適化による安全で堅牢なSim-to-Realポリシー学習sim2real2026/8/1
Lyapunov解析と進化最適化、統計的モデル検査を組み合わせ、シミュレーションから実世界への安全で堅牢なポリシー転送を実現するフレームワークを提案した。
- 滑らかな安全性構造化ポリシー合成による安全なオンライン学習安全強化学習2026/6/1
安全性監視と介入を行動生成に統合したポリシーアーキテクチャAutoSafeを提案し、性能追求と安全確保の行動を滑らかに切り替えることで、学習の滑らかさを保ちつつ安全性を確保する。
- 野生環境における四足歩行ロボットのランタイム学習歩行2025/3/1
四足歩行ロボットが動的な野生環境で安全に適応できるよう、強化学習エージェントと検証可能な物理モデルベースの制御器を組み合わせたランタイム学習フレームワークを提案し、シミュレーションで有効性を示した。
- 物理モデル誘導による最悪ケースサンプリングを用いた安全強化学習安全強化学習2024/12/1
物理モデルを活用して安全上重要なコーナーケースを重点的にサンプリングし、安全な強化学習ポリシーを効率的に学習する手法を提案した。
- Simplex機構による安全な継続学習マシンsim2real2024/9/1
高性能だが未検証の強化学習エージェントと、物理モデルに基づく検証済みの安全教師をSimplex論理で切り替え、生涯安全性を保証しながら実機で継続学習する枠組みを提案。
- 地図ベース経路計画のための強化学習における同変アンサンブルと正則化経路計画2024/3/1
強化学習において環境の対称性を活用するため、特殊なネットワーク部品を使わずに同変方策と不変価値関数を構築する同変アンサンブル法を提案し、訓練時の正則化項を加えることで、地図ベース経路計画タスクにおけるサンプル効率と性能を向上させた。
- Flexible Gear Assembly With Visual Servoing and Force Feedback2023/3/1
- 6IMPOSE: Bridging the Reality Gap in 6D Pose Estimation for Robotic Grasping2022/8/1
- Cloud-Edge Training Architecture for Sim-to-Real Deep Reinforcement Learning2022/3/1