Jing-Cheng Pang
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーション強化学習ベンチマーク強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReLAM: 視覚ロボットマニピュレーションのための予測モデルによる報酬学習マニピュレーション2025/9/1
画像から抽出したキーポイントで空間距離を推定し、行動なしの動画デモから予測モデルを用いて密な報酬を自動生成する階層強化学習フレームワークを提案。
- ImagineBench:大規模言語モデルのロールアウトを用いた強化学習の評価ベンチマーク強化学習ベンチマーク2025/5/15
LLMが生成した仮想経験(imaginary rollouts)と実環境のロールアウトを併用するオフライン強化学習アルゴリズムを評価する初のベンチマークを提案し、既存手法の課題と今後の研究方向を示した。
- 遅延報酬の単純和を超えて:強化学習のための非マルコフ報酬モデリング強化学習2024/10/26
遅延報酬が単純な報酬の和ではなく複雑な構造を持つ場合を扱うRLCoDe問題を提案し、非マルコフ成分の重み付き和でモデル化するCoDeTrを開発した。