Kexin Zheng
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションオフライン強化学習拡散方策/強化学習ゼロショットRL自動運転プランニング自動運転計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Copper-Policy: ロバストなロボットマニピュレーションのための表現学習マニピュレーション2026/9/26
方針と共にコンパクトな世界表現を学習し、ピクセル再構成なしで未来の観測埋め込みを予測することで、効率的な学習と高い制御性能を両立したロボットマニピュレーション手法。
- 価値スティッチングによる地平線適応型オフライン方策学習オフライン強化学習2026/6/1
固定長の価値バックアップを再帰的で地平線適応的な価値合成に置き換え、将来の状態と地平線長に条件付けられた補助価値関数とスティッチング方策を用いて、オフライン強化学習の性能を向上させる手法VASTを提案した。
- 二分的拡散方策最適化拡散方策/強化学習2026/1/1
拡散方策の強化学習において、報酬最大化と最小化の二つの方策に分解し、推論時にスコアを線形結合することで安定かつ制御可能な最適化を実現する手法を提案。
- 条件付き拡散モデルによる接触マップ転送で汎用性の高い巧みな把持を生成マニピュレーション2025/11/1
形状テンプレートから新規物体へ高品質な把持を転送するため、接触マップ生成を条件付き拡散モデルで定式化し、パートマップと方向マップも連鎖的に転送する枠組みを提案した。
- 堅牢なゼロショット強化学習に向けてゼロショットRL2025/10/1
オフライン学習時の分布外行動によるバイアスを行動正則化と拡散モデル・注意機構で抑え、ゼロショットRLの安定性と性能を高めるBREEZEを提案。
- フローマッチングに基づく対話行動モデリングを用いた自動運転プランニング自動運転プランニング2025/10/1
複雑な運転シーンでの対話行動をモデル化するため、軌道の細分化とフローマッチングを組み合わせたプランナーを提案し、大規模データセットで評価した。
- 柔軟なガイダンスを備えた拡散ベース自動運転プランニング自動運転計画2025/1/1
Transformerベースの拡散モデルで自動運転の閉ループ計画を行い、予測と計画を統合しつつ分類器ガイダンスで安全かつ適応的な軌道生成を実現した研究。