Pierre-Luc Bacon
収録論文 5本 ・ フィジカルAI/ロボット学習
強化学習VLAオフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 万能解を超えて:オフライン事前知識を用いた診断駆動型オンライン強化学習強化学習2026/6/24
オフライン事前知識の活用が強化学習に不可欠となる一方、その有効性は環境や学習過程で変化するため、単一の管理手法は最適でないと主張し、展開固有の証拠に基づく診断駆動型の緊張管理への転換を提案する論文。
- 表現学習がマルチタスク深層強化学習のスケーラビリティを実現する強化学習2026/6/4
モデルベース制御ではなく表現学習がマルチタスクRLのスケーラビリティの鍵であると主張し、予測的表現学習と高容量価値関数を組み合わせたモデルフリーアルゴリズムMR.Qを提案・評価した。
- 視覚言語行動モデルのための実用的な世界モデルベース強化学習に向けてVLA2026/3/1
VLAモデルの強化学習を実世界ではなく世界モデル内で行う枠組みVLA-MBPOを提案し、マルチビュー整合性と誤差蓄積を抑える設計で性能とサンプル効率を改善した。
- 明示的な保守性なしの長期ホライズンモデルベースオフライン強化学習オフライン強化学習2025/12/4
ベイズ的アプローチにより明示的な保守性を使わずに長期ホライズンのロールアウトを可能にし、D4RLとNeoRLで最先端性能を達成したNEUBAYを提案。
- Course Correcting Koopman Representations2023/10/1