Jan Brüdigam
RAI Institute
収録論文 10本 ・ フィジカルAI/ロボット学習
移動操作ロコ操作最適制御強化学習マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SMPCデモからのスパースオフライン・オンラインRLによる移動操作学習移動操作2026/8/1
シミュレーション内のSMPCを自動エキスパートとして用いて大規模オフラインデータを生成し、スパース報酬のみでオフポリシーRLエージェントを訓練することで、移動操作タスクを効率的に学習する手法を提案。低レベル安定化コントローラと統合し、教師を超える性能を実現。
- Sumo: 動的かつ汎用的な全身ロコ操作ロコ操作2026/4/1
事前学習した全身制御ポリシーをテスト時にサンプルベースのプランナーで操縦することで、脚式ロボットが大型・重量物を動的に操作できるようにするsim-to-real手法を提案。実機のSpotでタイヤの直立やバリアの引きずり等を実証し、シミュレーションで人型ロボットへの汎用性も示した。
- カーネルベース最適制御:無限小生成作用素によるアプローチ最適制御2024/12/1
再生核ヒルベルト空間上で非線形確率システムの最適制御を学習する手法を提案し、無限小生成作用素をデータから直接学習してHJB再帰と統合する。
- ロボティクスにおけるリー群を用いた姿勢表現の強化学習強化学習2024/9/1
ロボットや物体の姿勢をリー群構造に従ってニューラルネットワークで扱う簡単な入出力修正を提案し、姿勢制御やピックアンドプレースで性能を向上させた。
- Jacta: 器用な全身マニピュレーションを学習するための汎用プランナマニピュレーション2024/8/1
器用な手先と全身を使う複雑なマニピュレーションタスク向けに、強化学習のデモンストレーションを自動生成する柔軟な動作プランナを提案し、実機への転移も示した。
- Variational Integrators and Graph-Based Solvers for Multibody Dynamics in Maximal Coordinates2023/2/1
- Dext-Gen: Dexterous Grasping in Sparse Reward Environments with Full Orientation Control2022/6/1
- Dojo: A Differentiable Physics Engine for Robotics2022/3/1
- Linear-Time Contact and Friction Dynamics in Maximal Coordinates using Variational Integrators2021/9/1
- Linear-Time Variational Integrators in Maximal Coordinates2020/2/1