Scott Niekum
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 正則化潜在ダイナミクス予測は行動基盤モデルの強力なベースラインである強化学習2026/3/1
ゼロショット強化学習のための状態特徴学習において、複雑な表現学習目的が本当に必要かを検証し、潜在空間での次状態予測に直交性正則化を加えたシンプルな手法RLDPが、既存の複雑な手法と同等以上の性能を達成することを示した。
- DeepFleet: 大規模モバイルロボット群のためのマルチエージェント基盤モデル群制御2025/8/1
アマゾン倉庫の数十万台のロボットの移動データで訓練した4種類の基盤モデルを比較し、ロボット中心型とグラフ床型が最も有望であることを示した。
- 目標条件付き強化学習のためのヌル反事実的因子相互作用目標条件付き強化学習2025/5/6
物体中心タスクで後知恵リラベリングが失敗する問題に対し、原因物体が存在しなければ対象物体の遷移が変わったはずという「ヌル反事実」で相互作用を定義し、それを後知恵リラベリングと組み合わせて学習効率を改善する手法を提案した。
- 行動基盤モデルの高速適応強化学習2025/4/1
事前学習済み行動基盤モデルのゼロショット方策を、低次元タスク埋め込み空間での探索によりオンライン数ステップで高速適応させる手法を提案。
- RLZero: ドメイン内教師なしで言語から直接方策を推論VLA2024/12/1
言語指示から動画生成モデルで想像した観測を対象環境に投影し、教師なし強化学習で事前学習したエージェントが即座に模倣することで、追加学習なしに言語から行動を生成する手法を提案。
- SkiLD: 因子間相互作用に導かれた教師なしスキル発見教師なし強化学習2024/10/1
状態を因子に分解し、因子間の多様な相互作用を引き起こすスキルを教師なしで学習する手法を提案。家庭環境ロボットなど長期的な疎報酬タスクで既存手法を上回る。
- オフラインデータセットを用いた観察からの模倣学習への双対アプローチ模倣学習2024/6/1
専門家の行動データなしに観察のみから模倣するため、双対性原理に基づく多段効用関数を直接学習するDILOを提案し、高次元観察でも性能を向上させた。
- ロボットエアホッケー:強化学習のためのマニピュレーションテストベッドsim2real2024/5/1
ロボットエアホッケーを題材に、到達からブロック押し出しまで多様なタスクと2つのシミュレータ・実機を含む強化学習テストベッドを構築し、模倣学習・オフラインRL・スクラッチRLで評価した。
- SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning2023/11/1
- Hierarchical Empowerment: Towards Tractable Empowerment-Based Skill Learning2023/7/1
- Granger Causal Interaction Skill Chains2023/6/1
- Dual RL: Unification and New Methods for Reinforcement and Imitation Learning2023/2/1
- Understanding Acoustic Patterns of Human Teachers Demonstrating Manipulation Tasks to Robots2022/11/1
- Can Foundation Models Perform Zero-Shot Task Specification For Robot Manipulation?2022/4/1
- A Ranking Game for Imitation Learning2022/2/1
- You Only Evaluate Once: a Simple Baseline Algorithm for Offline RL2021/10/1
- Distributional Depth-Based Estimation of Object Articulation Models2021/8/1
- Self-Supervised Online Reward Shaping in Sparse-Reward Environments2021/3/1
- SCAPE: Learning Stiffness Control from Augmented Position Control Experiences2021/2/1
- The EMPATHIC Framework for Task Learning from Implicit Human Feedback2020/9/1
- ScrewNet: Category-Independent Articulation Model Estimation From Depth Images Using Screw Theory2020/8/1
- Understanding Teacher Gaze Patterns for Robot Learning2019/7/1
- A Review of Robot Learning for Manipulation: Challenges, Representations, and Algorithms2019/7/1
- Learning Hybrid Object Kinematics for Efficient Hierarchical Planning Under Uncertainty2019/7/1
- Uncertainty-Aware Data Aggregation for Deep Imitation Learning2019/5/1
- LAAIR: A Layered Architecture for Autonomous Interactive Robots2018/11/1
- Towards Online Learning from Corrective Demonstrations2018/10/1
- One-Shot Learning of Multi-Step Tasks from Observation via Activity Localization in Auxiliary Video2018/6/1
- Efficient Hierarchical Robot Motion Planning Under Uncertainty and Hybrid Dynamics2018/2/1