Bernhard Schölkopf
収録論文 28本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 感覚運動世界モデル:逆動力学による行動のための知覚世界モデル2026/6/18
逆動力学正則化を導入した潜在世界モデルを提案し、表現の崩壊を防ぎつつ行動に関連する表現を学習することで、報酬なしの軌跡から効率的な計画を可能にする。
- 言語モデルの事前知識を用いた観測からのPOMDP世界モデル学習世界モデル2026/5/13
LLMが少数の観測・行動軌跡からPOMDPモデルを提案・反復改良し、信念ベースの尤度を最適化することで、部分観測環境でのサンプル効率的な世界モデル学習を実現した。
- 有界比率強化学習強化学習2026/4/20
PPOのヒューリスティックなクリップ目的と信頼領域法の理論的ギャップを埋めるため、有界比率強化学習(BRRL)フレームワークを提案し、解析的最適解と単調性能改善を保証する新しいポリシー最適化アルゴリズムBPOを開発した。
- 筋肉駆動ロボットのための一般化アクチュエータネットワークによるシミュレーションから実機への転移sim2real2026/4/1
腱駆動と空気圧人工筋肉を用いたロボットアームの複雑なアクチュエーションをニューラルネットワークでモデル化し、シミュレーションで訓練した動的で精密なポリシーを実機に転移させる手法を提案した。
- 構造化ワールドモデルのための自然な構成要素:理論・証拠・スケーリングワールドモデル2025/11/3
離散過程と連続過程を基本構成要素とし、HMMやsLDSを階層的に組み合わせることで、解釈性を保ちつつ生成・予測・計画・意思決定を同一アーキテクチャで行う構造化ワールドモデルの枠組みを提案する。
- 大規模な器用なロボットピアノ演奏マニピュレーション2025/11/1
人間の実演なしに強化学習と模倣学習を組み合わせ、約1000曲を演奏できるロボットハンドを実現した。
- 単視点メッシュ再構成はロボティクスに使えるか?sim2real2025/5/1
単視点の3Dメッシュ再構成手法をロボットマニピュレーション向けの物理シミュレーションに使えるか評価し、既存手法がロボット特有の要件を満たせないことを示した。
- RP1M: 両手多指ロボットハンドによるピアノ演奏のための大規模動作データセットマニピュレーション2024/8/1
両手多指ロボットによるピアノ演奏の動作データを100万軌道以上集めた大規模データセットRP1Mを構築し、模倣学習のベンチマークで最先端性能を達成した。
- 拡散モデルによる接触計画学習で実現する俊敏な跳躍移動歩行2024/3/1
飛び石のような制約環境での俊敏な移動のため、NMPCとMCTSで接触計画を生成し、拡散モデルで目標条件付き方策を学習した。
- 身体性AIの基盤世界モデルにおける因果性の本質的役割身体性AI2024/2/1
身体性AIのための基盤世界モデルに因果性を取り入れる重要性を論じ、物理的相互作用の正確な予測に向けた展望と誤解の整理を行った位置論文。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Data-Efficient Online Learning of Ball Placement in Robot Table Tennis2023/8/1
- Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World2023/8/1
- Benchmarking Offline Reinforcement Learning on Real-Robot Hardware2023/7/1
- Safe & Accurate at Speed with Tendons: A Robot Arm for Exploring Dynamic Motion2023/7/1
- Synchronizing Machine Learning Algorithms, Realtime Robotic Control and Simulated Environment with o802023/6/1
- Hindsight States: Blending Sim and Real Task Elements for Efficient Reinforcement Learning2023/3/1
- AIMY: An Open-source Table Tennis Ball Launcher for Versatile and High-fidelity Trajectory Generation2022/10/1
- Physical Derivatives: Computing policy gradients by physical forward-propagation2022/1/1
- Compositional Multi-Object Reinforcement Learning with Linear Relation Networks2022/1/1
- Real Robot Challenge: A Robotics Competition in the Cloud2021/9/1
- Causal Curiosity: RL Agents Discovering Self-supervised Experiments for Causal Representation Learning2020/10/1
- CausalWorld: A Robotic Manipulation Benchmark for Causal Structure and Transfer Learning2020/10/1
- TriFinger: An Open-Source Robot for Learning Dexterity2020/8/1
- Learning to Play Table Tennis From Scratch using Muscular Robots2020/6/1
- Reliable Real Time Ball Tracking for Robot Table Tennis2019/8/1
- Adaptation and Robust Learning of Probabilistic Movement Primitives2018/8/1
- Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning2017/6/1