Zhiwei Shang
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習軌道計画歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 保守的ソフトアクタークリティックによる効果的な強化学習制御強化学習2025/5/1
エントロピーと相対エントロピー正則化を組み合わせたCSACを提案し、探索と安定性のバランスを改善してロボット制御タスクでの性能を向上させた。
- 信号なし交差点における安全重視軌道計画のための拡散モデルと動的高次制御バリア関数軌道計画2024/12/1
拡散モデルと動的高次制御バリア関数を組み合わせ、信号のない交差点で左折・右折・直進を安全かつ効率的に計画する手法を提案。
- 選好整合拡散プランナによる四足歩行制御歩行2024/10/1
報酬ラベルなしの専門家データで拡散プランナをオフライン学習し、弱い選好ラベリングを用いたオンライン強化学習でロバスト性を高め、四足歩行の速度追従と実機ゼロショット転移を実現した。