Robert Wright
収録論文 6本 ・ フィジカルAI/ロボット学習
世界モデル強化学習全身マニピュレーションsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CF-JEPA: 可制御性の因子分解によるJEPA世界モデルのロバスト性向上世界モデル2026/9/30
JEPA型世界モデルの潜在空間を制御可能・不可能な部分空間に分離し、背景の妨害情報に頑健なモデルを実現した研究。
- 報酬を観測として:迅速な適応のための報酬ベース方策の学習強化学習2026/9/30
報酬と行動のみを条件とする方策を提案し、観測空間が全く異なる環境へのゼロショット適応を実現した。
- AdaptManip: オンライン再帰的状態推定による適応的な全身物体持ち上げ・運搬の学習全身マニピュレーション2026/2/1
ヒューマノイドが強化学習のみで物体の持ち上げと運搬を自律的に行う枠組みを提案し、再帰的物体状態推定とLiDAR自己位置推定を組み合わせて実機でゼロショット動作を実現した。
- PrivilegedDreamer: 特権情報の明示的想像による学習済み方策の迅速な適応sim2real2025/2/1
隠れパラメータを持つMDP問題に対し、履歴から隠れパラメータを推定する二重再帰構造を組み込んだモデルベース強化学習手法を提案し、sim-to-real適応性能を向上させた。
- 論理仕様に基づく動的タスクサンプリングによる強化学習強化学習2024/2/1
高レベルな論理仕様から強化学習エージェントを効率的に学習させるため、環境や報酬機械の事前知識なしに有望なタスクを動的にサンプリングする手法を提案し、グリッドワールドやロボット操作タスクでサンプル効率の向上を示した。
- A Framework for Few-Shot Policy Transfer through Observation Mapping and Behavior Cloning2023/10/1