Sebastian Trimpe
RWTH Aachen University
収録論文 43本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ベイズ最適化による制御器チューニングとロボット学習の10年:チュートリアル、レビュー、将来展望ベイズ最適化2026/9/8
ベイズ最適化(BO)を制御器チューニングとロボット学習に応用する研究を10年分レビューし、実践的な導入方法や課題、標準ベンチマークの不足を指摘して軽量ベンチマークを提案したチュートリアル論文。
- WarpMPC: ADMMと展開LDL^T分解によるGPU上の大規模バッチMPCMPC/GPU最適化2026/7/1
GPU上で多数の同一構造を持つMPC問題を高速に解くための数値最適化手法を提案し、JAX/WarpベースのツールボックスWarpMPCを実装した。
- 安全で写実的なドローンライトショーのための生成AI群制御2026/6/1
テキストプロンプトから写実的で衝突のない大規模ドローン編隊の振り付けを自動生成するパイプラインSWANを提案し、シミュレーションと実機で検証した。
- すべてのモデルは誤り、どこが誤りかを知ることが有用:強化学習におけるモデル不確実性についてモデルベース強化学習2026/5/31
モデルベース強化学習におけるモデルの不正確さを扱う枠組みを提案し、不確実性を適切に扱うことでモデルの悪用を防ぎ、ハードウェア上での直接学習や安全な探索の成功を示した。
- 数分でレースを学習:Mini WheelbotにおけるInfoprop Dyna強化学習2026/5/1
実機のMini Wheelbot(一輪車ロボット)が、モデルベース強化学習フレームワークInfoprop Dynaを用いて、実世界でのインタラクションのみから11分でトラックを周回するレースを学習できることを実証した論文。
- クラッシュフィードバックを考慮した選好ベイズ最適化ベイズ最適化2026/4/1
ロボット制御のパラメータ学習において、実験のクラッシュ情報を選好比較に組み込めるCrashPBOを提案し、クラッシュ回数を63%削減しつつデータ効率を向上させた。
- Crazyflie Brushlessのモデリング手法ドローン制御2026/3/1
Crazyflie Brushlessの動力学モデルを構築し、パラメータ同定を行った。シミュレーションと実機でモデル精度を評価し、強化学習による制御器学習とバックフリップ習得への応用を示した。
- Mini Wheelbotデータセット:ロボット学習のための高忠実度データデータセット/ロボット学習2026/1/1
オープンソースのバランス型一輪車ロボット「Mini Wheelbot」の1kHz同期センサ・状態推定・モーションキャプチャ・動画を含む動力学データセットを公開し、モデル学習や状態推定のベンチマーク例を示した。
- ベイズ最適化による再学習不要のニューラルネットワーク近似MPCのファインチューニング制御/ベイズ最適化2025/12/1
ベイズ最適化を用いて、再学習なしにニューラルネットワーク近似モデル予測制御のパラメータを実験データから自動調整する手法を提案し、倒立振子や一輪車ロボットのハードウェア実験で有効性を示した。
- ニュートン型とラグランジュ型ニューラルネットワーク:効率的な逆動力学同定に向けた比較逆動力学/物理情報NN2025/6/1
産業用ロボットの逆動力学同定において、ニュートン型とラグランジュ型の物理情報ニューラルネットワークを比較し、モータトルク推定時には散逸トルクを明示的にモデル化しないラグランジュ型が劣ることを示した。
- 拡散モデルによる近似MPC:マルチモーダル行動分布の高速で一貫した模倣マニピュレーション2025/4/1
拡散モデルを用いてモデル予測制御(MPC)を模倣学習し、マルチモーダルな解分布を正確に表現することで、7自由度ロボットアームを250Hzで高速かつ一貫して制御する手法を提案した。
- ミニホイールボット:学習ベースのバランス制御、フリップ、多関節走行のためのテストベッド学習ベース制御2025/2/1
反応ホイール式一輪車ロボット「ミニホイールボット」を開発し、ベイズ最適化によるバランス制御と模倣学習による走行制御の有効性を実証した。
- CHEQによる研磨作業のための安全な可変インピーダンス学習マニピュレーション2025/1/1
適応型ハイブリッド強化学習CHEQをロボット研磨に適用し、シミュレーションと実機で可変インピーダンス制御の有効性と安全性を検証した。
- 純粋な合成データから動的システムの基盤モデルを構築基盤モデル2024/12/1
再現核ヒルベルト空間から動的関数をサンプリングして合成データのみでTransformer基盤モデルを事前学習し、様々な動的システムの予測に汎化できることを示した。
- シミュレーション支援によるブラックボックスロボット学習のための方策チューニングsim2real2024/11/1
シミュレータを追加の情報源として活用し、実機での試行回数を抑えながら方策を効率的に改善するブラックボックス方策探索アルゴリズムを提案した。
- 単一軌道から変形可能な線状物体のダイナミクスを学習変形物体操作2024/7/1
変形可能な線状物体を剛体の連鎖と弾性関節でモデル化し、物理情報を組み込んだニューラルODEを30秒のデータだけで学習して高精度な運動予測を実現した。
- Tracking Object Positions in Reinforcement Learning: A Metric for Keypoint Detection (extended version)2023/12/1
- Data-efficient Deep Reinforcement Learning for Vehicle Trajectory Control2023/11/1
- Pseudo-rigid body networks: learning interpretable deformable object dynamics from partial observations2023/7/1
- Robust Direct Data-Driven Control for Probabilistic Systems2023/6/1
- Multimodal Multi-User Surface Recognition with the Kernel Two-Sample Test2023/3/1
- Learning Fast and Precise Pixel-to-Torque Control2022/8/1
- The Wheelbot: A Jumping Reaction Wheel Unicycle2022/7/1
- Learning by Doing: Controlling a Dynamical System using Causality, Control, and Reinforcement Learning2022/2/1
- Safe Value Functions2021/5/1
- GoSafe: Globally Optimal Safe Robot Learning2021/5/1
- Structured learning of rigid-body dynamics: A survey and unified view from a robotics perspective2020/12/1
- Robot Learning with Crash Constraints2020/10/1
- Learning Event-triggered Control from Data through Joint Optimization2020/8/1
- Excursion Search for Constrained Bayesian Optimization under a Limited Budget of Failures2020/5/1
- Learning Constrained Dynamics with Gauss Principle adhering Gaussian Processes2020/4/1
- Safe and Fast Tracking on a Robot Manipulator: Robust MPC and Neural Network Control2019/12/1
- Actively Learning Gaussian Process Dynamics2019/11/1
- A Learnable Safety Measure2019/10/1
- Robust Model-free Reinforcement Learning with Multi-objective Bayesian Optimization2019/10/1
- Classified Regression for Bayesian Optimization: Robot Learning with Unknown Penalties2019/7/1
- Data-efficient Auto-tuning with Bayesian Optimization: An Industrial Control Study2018/12/1
- Gait learning for soft microrobots controlled by light fields2018/9/1
- Model-Based Policy Search for Automatic Tuning of Multivariate PID Controllers2017/3/1
- Virtual vs. Real: Trading Off Simulations and Physical Experiments in Reinforcement Learning with Bayesian Optimization2017/3/1
- Automatic LQR Tuning Based on Gaussian Process Global Optimization2016/5/1
- Depth-Based Object Tracking Using a Robust Gaussian Filter2016/2/1
- A New Perspective and Extension of the Gaussian Filter2015/4/1