Zhenghao Peng
収録論文 20本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DiSCo: 共有自律のための拡散シーケンスコパイロット共有自律制御2026/3/1
共有自律制御において、拡散ポリシーを用いてユーザーの行動履歴に整合する行動シーケンスを計画する手法DiSCoを提案し、シミュレーションの運転・ロボットアームタスクで性能を向上させた。
- Alpamayo-R1: 長尾シナリオにおける汎化可能な自動運転のための推論と行動予測の橋渡し自動運転/VLA2025/11/1
視覚言語行動モデルに因果連鎖推論を組み込み、拡散ベースの軌道デコーダと強化学習を組み合わせることで、長尾の安全臨界シナリオでの自動運転計画精度と推論品質を向上させた研究。
- 人間介入からの予測的選好学習模倣学習2025/10/1
人間の介入に含まれる暗黙の選好信号を将来のロールアウト予測に活用し、安全性が重要な領域へ修正を伝播させる学習手法を提案。
- Adv-BMT: 安全クリティカルな交通シナリオ生成のための双方向モーショントランスフォーマー自動運転シミュレーション2025/6/1
逆方向の交通運動予測を行う双方向モーショントランスフォーマーを用いて、現実の交通シナリオに多様でリアルな敵対的衝突インタラクションを付加するフレームワークを提案し、拡張データセットでの学習により衝突率を20%削減できることを示した。
- 適応的介入機構によるロボット主導の対話型模倣学習模倣学習2025/6/1
人間の介入要求を適応的に判断するプロキシQ関数を導入し、専門家の監視負担を大幅に減らすロボット主導の対話型模倣学習手法を提案した。
- SceneStreamer: 次トークングループ予測による連続的シナリオ生成自動運転シミュレーション2025/6/1
交通シナリオ全体をトークン列として表現し、Transformerで自己回帰的に生成することで、エージェントの出入りを伴う長期的な運転シミュレーションを可能にした研究。
- 人間の介入から効率的に学ぶ移動ロボットのオンライン学習手法sim2real2025/3/1
模倣学習と強化学習を組み合わせ、報酬設計や事前学習なしに人間のオンライン介入と実演からリアルタイムで方策を学習する手法を提案し、脚式四足歩行ロボットと車輪型配送ロボットで15分以内に訓練を完了できることを示した。
- 代理価値伝播による能動的な人間関与からの学習模倣学習2025/2/1
人間の介入とデモンストレーションを代理価値関数で表現し、TD学習で伝播させることで、報酬なしに方策を最適化する手法を提案した。
- Vid2Sim: 動画から都市ナビゲーション向けのリアルでインタラクティブなシミュレーションを生成sim2real2025/1/1
単眼動画からフォトリアルで物理的に操作可能な3D都市環境を再構成し、視覚ナビゲーションエージェントの強化学習を可能にするreal2simフレームワークを提案。
- MetaVQA:視覚言語モデルのための具現化シーン理解ベンチマークVLA2025/1/1
自動運転向けに、nuScenesとWaymoのデータからVQAペアを自動生成し、視覚言語モデルの空間推論と閉ループ意思決定を評価・改善するベンチマークMetaVQAを提案した。
- 介入型拡散アシスタンスによる共有自律制御共有自律制御2024/9/1
人間とAIが協調して操作する共有自律制御において、AIが常時介入するのではなく、人間の行動より価値が高い場合にのみ介入する拡散モデルベースの手法を提案し、シミュレーションと人間参加実験で性能と自律性の向上を示した。
- ScenarioNet: Open-Source Platform for Large-Scale Traffic Scenario Simulation and Modeling2023/6/1
- Guarded Policy Optimization with Imperfect Online Demonstrations2023/3/1
- TrafficGen: Learning to Generate Diverse and Realistic Traffic Scenarios2022/10/1
- Human-AI Shared Control via Policy Dissection2022/6/1
- Learning to Drive by Watching YouTube Videos: Action-Conditioned Contrastive Policy Pretraining2022/4/1
- Efficient Learning of Safe Driving Policy via Human-AI Copilot Optimization2022/2/1
- Safe Driving via Expert Guided Policy Optimization2021/10/1
- MetaDrive: Composing Diverse Driving Scenarios for Generalizable Reinforcement Learning2021/9/1
- Improving the Generalization of End-to-End Driving through Procedural Generation2020/12/1