Bei Peng
収録論文 3本 ・ フィジカルAI/ロボット学習
多目的強化学習自動運転/交通流モデリング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LEMUR: 嗜好フィードバックを用いた多目的強化学習によるアライメント学習多目的強化学習2026/7/1
複数の競合する目的を持つタスクにおいて、複数の人間の嗜好フィードバックから報酬モデルと方策を同時に学習する新しいフレームワークを提案し、ベンチマークタスクで優れた性能を示した。
- 知識注入型深層学習による汎化性能と安定性を最適化した車両追従モデル自動運転/交通流モデリング2025/4/1
大規模言語モデルから車両追従の知識を蒸留し、安定性制約を組み込んだ軽量モデルを構築することで、未知の交通シナリオでも汎化し安定動作する車両追従モデルを実現した。
- Accelerating Laboratory Automation Through Robot Skill Learning For Sample Scraping2022/9/1