Shengfan Cao
収録論文 3本 ・ フィジカルAI/ロボット学習
模倣学習/ドメイン転移安全強化学習模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 状態条件付き敵対的学習:エンドツーエンド模倣学習のためのオフポリシー視覚ドメイン転移手法模倣学習/ドメイン転移2025/12/1
目標ドメインのデータがオフポリシーで専門家なし・少量という難設定での視覚的ドメイン転移のため、状態条件付き潜在分布を敵対的に整合させる手法を提案し、自動運転シミュレータで有効性を示した。
- サンプリングベースの重み空間射影による制約付き方策最適化安全強化学習2025/12/1
微分不可能な安全制約をサンプリングで評価し、パラメータ空間で射影することで、安全性を保ちながら方策を改善する手法SCPOを提案した。
- 制約を考慮した模倣学習のシンプルなアプローチ:自動運転レースへの応用模倣学習2025/3/1
模倣学習の目的関数に安全性制約を簡単に組み込む手法を提案し、自動運転レースのシミュレーションで従来の行動クローニングより制約遵守と性能の一貫性が向上することを示した。