Oleh Rybkin
収録論文 13本 ・ フィジカルAI/ロボット学習
マニピュレーション模倣学習sim2real強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 実世界強化学習による能動的知覚行動の獲得マニピュレーション2025/12/1
訓練時のみ利用可能な特権センサを活用した非対称アドバンテージ重み付き回帰(AAWR)を提案し、部分観測下で情報収集する能動的知覚行動を実ロボットで効率的に学習させる手法を実証した。
- 模倣学習のための潜在拡散プランニング模倣学習2025/4/1
行動なしのデモと準最適データを活用するため、潜在空間上で動くプランナーと逆動力学モデルを拡散目的で訓練するLDPを提案し、視覚ロボット操作タスクで既存手法を上回った。
- Video2Policy: インターネット動画を活用したシミュレーションでのマニピュレーションタスクのスケーリングsim2real2025/2/1
インターネット上の人間行動動画からシミュレーションタスクを再構築し、LLM生成報酬による強化学習で汎用方策を訓練、実機転移も実現したフレームワーク。
- 特権センシングによる強化学習の足場づくり強化学習2024/5/1
訓練時のみ利用可能な高価なセンサ情報を批評家や世界モデルなどの補助要素に活用し、安価なセンサのみで動作する方策を効率的に学習する手法「Scaffolder」を提案。
- METRA: Scalable Unsupervised RL with Metric-Aware Abstraction2023/10/1
- Planning Goals for Exploration2023/3/1
- Discovering and Achieving Goals via World Models2021/10/1
- Know Thyself: Transferable Visual Control Policies Through Robot-Awareness2021/7/1
- Model-Based Reinforcement Learning via Latent-Space Collocation2021/6/1
- Reinforcement Learning with Videos: Combining Offline Observations with Interaction2020/11/1
- Long-Horizon Visual Planning with Goal-Conditioned Hierarchical Predictors2020/6/1
- Planning to Explore via Self-Supervised World Models2020/5/1
- Learning Predictive Models From Observation and Interaction2019/12/1