Zengqi Peng
収録論文 18本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 量子化行動表現を用いたオフライン強化学習による信頼性の高い駐車ポリシーの学習自動運転/駐車2026/9/17
LiDAR特徴を目標姿勢に適応させ、ウェイポイント列を離散トークンに量子化して保守的Q学習を行うオフライン強化学習により、対話を考慮した自動駐車を実現し、CARLAで最高の成功率と未見スロットへの転移を示した。
- 拡散モデルを用いた動的ニューラルクープマン蒸留によるリアルタイムロボット制御制御/蒸留2026/5/1
拡散モデルの反復ノイズ除去による遅延を解消するため、多段階推論を単一パスに蒸留しつつ多様性を保つフレームワークを提案し、D4RLベンチマークと実機で高速な閉ループ制御を実証した。
- VLMベースのマルチエージェント協調による自動運転ポリシー学習フレームワークOGR自動運転2025/9/1
視覚言語モデルを活用したマルチエージェント協調により、報酬関数と訓練カリキュラムの設計を自動化し、自動運転ポリシーをオンラインで進化させるフレームワークを提案した。
- SEG-Parking: エンドツーエンドオフライン強化学習による安全・効率的・汎用的な自動駐車自動運転/強化学習2025/9/1
駐車シーン用データセットを構築し、目標条件付き状態エンコーダと保守的正則化付きオフライン強化学習を組み合わせることで、対向車との相互作用を含む自動駐車を実現した研究。
- DECAMP: シーン整合性を考慮したマルチエージェント運動予測のための分離型コンテキスト認識事前学習マルチエージェント運動予測2025/9/1
自動運転におけるマルチエージェント軌道予測の精度向上のため、表現学習とpretextタスクを分離したコンテキスト認識型事前学習フレームワークDECAMPを提案し、Argoverse 2で優れた性能を示した。
- SocialTraj: 条件付き拡散モデルによる自動運転向け二段階の社会的配慮型軌道予測軌道予測2025/9/1
社会価値志向(SVO)をベイズ逆強化学習で推定し、条件付き拡散モデルに組み込むことで、周囲車両の多様な運転行動を社会的に整合した形で予測する手法を提案した。
- 二層マルチアームドバンディットに基づく階層型強化学習による無信号交差点での相互作用を考慮した自動運転自動運転/階層型強化学習2025/2/1
無信号交差点での自動運転に向け、周囲車両の不確実性を考慮した二層マルチアームドバンディットベースの階層型強化学習フレームワークBiM-ACPPOを提案し、CARLAでの実験で優れた性能と汎化性を示した。
- 遮蔽環境に対応した自律走行のためのコンティンジェンシー安全臨界プランニングプランニング2025/2/1
遮蔽された動的環境で自律走行車の安全性と走行効率を両立するため、到達可能性解析と時空間バリア制約を用いたリアルタイム軌道生成手法を提案し、実機実験で有効性を示した。
- LearningFlow: 大規模言語モデルによる都市運転のための自動方策学習ワークフロー自動運転/強化学習2025/1/1
複数のLLMエージェントが協調してカリキュラムと報酬関数を自動生成し、都市運転の強化学習方策を効率的に学習させるフレームワークを提案した。
- CALMM-Drive: 大規模マルチモーダルモデルによる信頼度を考慮した自動運転自動運転2024/12/1
大規模マルチモーダルモデルと拡散モデルを組み合わせ、信頼度に基づく候補選択で自動運転の意思決定と軌道計画を統合したフレームワークを提案。
- スペクトル注意ネットワークとPPOによる意図予測と意思決定の統合自動運転/意思決定2024/8/1
周囲車両の意図予測と意思決定を明示的に結合し、スペクトル注意ネットとPPOで効率的に学習する自動運転フレームワークを提案した。
- 報酬駆動型自動カリキュラム学習による無信号交差点でのインタラクション対応自動運転自動運転/強化学習2024/3/1
周囲車両の意図や台数の不確実性に対応するため、報酬に基づく自動カリキュラム強化学習を提案し、無信号交差点での安全な自動運転を実現した。
- 自動運転におけるフェイルオペレーショナル制御のための増分ベイズ学習自動運転/安全制御2024/3/1
周囲車両の急な挙動や環境外乱による不確実性に対応するため、増分ベイズ学習で外乱をオンライン推定し、確率的制御バリア関数に基づくQP制御で自動運転車を安全状態へ収束させる手法を提案した。
- Real-Time Parallel Trajectory Optimization with Spatiotemporal Safety Constraints for Autonomous Driving in Congested Traffic2023/9/1
- Curriculum Proximal Policy Optimization with Stage-Decaying Clipping for Self-Driving at Unsignalized Intersections2023/8/1
- Learning the References of Online Model Predictive Control for Urban Self-Driving2023/8/1
- Spatiotemporal Receding Horizon Control with Proactive Interaction Towards Autonomous Driving in Dense Traffic2023/8/1
- Chance-Aware Lane Change with High-Level Model Predictive Control Through Curriculum Reinforcement Learning2023/3/1