Majid Khadiv
Technical University of Munich
収録論文 59本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FERPO: 前方エントロピー正則化方策最適化強化学習2026/10/1
クリティックの行動微分を使わず、前方KL目的と自己正規化重要度サンプリングで方策改善を行う最大エントロピー強化学習アルゴリズムを提案し、連続制御タスクで性能とサンプル効率を向上させた。
- Res-HIL: 人間誘導型残差強化学習によるサンプル効率の良い器用なマニピュレーションマニピュレーション2026/9/24
模倣学習で得た方策を凍結し、その上に人間の介入から学ぶ残差方策を重ねることで、短時間のオンライン学習で接触の多い器用な操作タスクを高精度に実現する手法を提案。
- Adaptive-MHE:移動ホライズン推定を用いた脚式ロコマニピュレーションのためのサンプリングベース適応MPCロコマニピュレーション2026/9/15
物体や地形の質量・摩擦などの物理パラメータを移動ホライズン推定でオンライン推定し、サンプリングベースMPCと組み合わせることで、未知環境下での脚式ロコマニピュレーションを適応的に実現するフレームワークを提案。
- 確率的到達可能動作検証:セットベース学習による視覚運動ポリシーの検証検証/到達可能性2026/8/3
視覚エンコーダを固定し、下流ポリシーとの低次元インターフェースにセット伝播を限定することで、視覚運動ポリシーの到達可能性解析を効率化し、セットベース学習で動作偏差を直接最適化して確率的到達可能半径を縮小する手法を提案。
- PAC-DP: PACベイズ拡散ポリシー学習ロボットポリシー学習2026/7/1
拡散ポリシーの訓練にPACベイズ理論に基づく正則化を導入し、ロボット操作タスクでの性能を向上させる手法を提案した論文。
- FARO: 実現可能性を考慮したロボット動作最適化移動操作/動作計画2026/7/1
接触系列の実現可能性を高速に判定し、動的に整合する軌道を生成するネスト型キノダイナミクスフレームワークを提案。LLMによる接触計画サンプリングと探索を統合し、実世界の移動操作タスクで実行可能な軌道を生成する。
- 拡散ポリシーを用いた新行動の誘導的発見拡散ポリシー/行動生成2026/6/1
拡散ポリシーのサンプリングを誘導し、多様で実行可能な新しい行動を系統的に発見・学習するフレームワークを提案した。
- Humanoid-DART: 拡散ガイドによるリラベリングと追跡を用いたヒューマノイド移動操作移動操作2026/6/1
少数のデモから自己教師ありで行動レパートリーを拡張し、拡散モデルによる軌道生成と強化学習を組み合わせてヒューマノイドの移動操作ポリシーを学習する手法を提案した。
- MotionDisco: 極限ヒューマノイド移動操作のための動作発見移動操作/進化探索/LLM2026/6/1
テレオペや人間のデモを使わずに、LLMガイドの進化探索と軌道最適化を組み合わせて、長期的な接触リッチなヒューマノイド移動操作動作をゼロから発見し、実機に転移するフレームワークを提案。
- Shield-Loco: 予測的安全フィルタリングによる歩行ポリシーの保護歩行2026/6/1
強化学習による歩行ポリシーに対し、衝突予測に基づいて接触位置を事後フィルタリングする安全フィルタを提案。実機四足ロボットで安全性違反を大幅に削減しつつ、タスク性能の低下を最小限に抑えた。
- Safe-Night VLA: 熱知覚視覚言語行動モデルによる安全クリティカルなマニピュレーションVLA2026/3/1
RGBでは見えない熱情報をVLAモデルに統合し、制御バリア関数による安全フィルタを組み合わせることで、非構造環境での安全な熱認識マニピュレーションを実現した研究。
- SLowRL: 安全な低ランク適応強化学習による歩行制御歩行2026/3/1
シミュレーションで学習した歩行ポリシーを実機で安全かつ効率的に微調整するフレームワークSLowRLを提案。低ランク適応と回復ポリシーによる安全制約を組み合わせ、Unitree Go2ロボットでのジャンプとトロットタスクで微調整時間を46.5%削減し、安全性違反をほぼゼロにした。
- Hippo: 汎用制約付き軌道最適化のための高性能内点法・射影法ソルバー軌道最適化2026/3/1
ロボットの軌道最適化問題を解くための新しいソルバーHippoを提案。不等式制約には適応バリア更新を伴う内点法、等式制約には射影法や内点法を用い、既存手法より高速で堅牢に高品質な解を得られる。
- DynaRetarget: サンプリングベース軌道最適化による動的実行可能なモーションリターゲティングsim2real2026/2/1
人間の動作をヒューマノイドの制御ポリシーに転写するパイプラインを提案し、サンプリングベース軌道最適化で運動学的軌道を動的に実行可能な動作へと精錬する。
- SURE: 軌道最適化による安全な不確実性対応ロボット環境インタラクション軌道最適化2026/2/1
接触タイミングの不確実性を考慮し、複数の軌道分岐と再統合を可能にする軌道最適化フレームワークを提案。カートポールと卵キャッチの実験で成功率を大幅に改善。
- ロボティクスにおける大域最適化への合意形成ベース最適化(CBO)の導入軌道最適化2026/2/1
ロボットの軌道最適化に、緩やかな仮定の下で大域的最適解への収束が保証される合意形成ベース最適化(CBO)を導入し、既存手法より低コストを達成できることを示した。
- 接触を通じて行動を学ぶ:マルチタスクロボット学習の統一的な視点マニピュレーション2025/10/1
接触目標(位置・タイミング・部位)でタスクを統一定義し、目標条件付き強化学習で四足歩行・人型歩行・双腕操作を単一ポリシーで実現するフレームワークを提案。
- ヒューマノイドの移動操作のためのタスク・動作計画移動操作2025/8/1
接触モードの共有表現を用いて移動と操作を統合した最適化ベースのタスク・動作計画フレームワークを提案し、全身動力学と制約を考慮した長期的な移動操作行動を生成できることを示した。
- 動的ロコモーションのための接触順序とパッチ計画の同時最適化歩行2025/8/1
モンテカルロ木探索と全身軌道最適化を組み合わせ、四足歩行ロボットの接触順序と接地位置を同時に計画する手法を提案し、実機実験で有効性を示した。
- モデル予測最適化パス積分による脚式ロボットの制御歩行2025/8/1
MPPIにクロスエントロピー法と共分散行列適応法を組み合わせたMPOPIを提案し、四足ロボットの全身運動生成において少ないサンプルで優れた移動性能を実現した。
- UniConFlow:認定動作計画のための統合制約付きフローマッチングフレームワーク動作計画2025/6/1
等式・不等式制約を統合的に扱うフローマッチングベースの軌道生成フレームワークを提案し、二重倒立振子や実機マニピュレーションで有効性を示した。
- 潜在拡散モデルによる物理的に整合したヒューマノイドの移動操作移動操作2025/4/1
潜在拡散モデルで生成した人間と物体のインタラクション画像から接触位置とロボット姿勢を抽出し、全身軌道最適化に用いることで、物理的に整合したヒューマノイドの長期的な移動操作軌道を生成する手法を提案した。
- 接触を伴うロボットの物理的に整合した慣性パラメータ同定システム同定2024/9/1
接触力を直接測れない四足歩行ロボットでも、関節トルクと接触制約の零空間射影を使って慣性パラメータを同定する手法を提案し、Spotで検証した。
- 接触条件付き多歩容ロコモーションポリシーの学習歩行2024/8/1
脚式ロボットの多歩容学習において、将来の接地切り替えを条件として与えることで、単一ポリシーが複数歩容を生成でき、訓練分布外でも汎化しやすいことを示した。
- モンテカルロ木探索と教師あり学習による非歩容的脚式移動歩行2024/8/1
サンプリングベース手法と教師あり学習を組み合わせ、脚式ロボットの歩容系列とタイミングを最適化する手法を提案し、シミュレーションと実機で有効性を検証した。
- MPCからの安全な移動スキル学習歩行2024/7/1
モデル予測制御(MPC)を専門家として活用し、安全なデータ集約手法により移動スキルを安全に学習するフレームワークを提案。訓練中の失敗を大幅に削減し、外乱に対するロバスト性も向上させる。
- 接触タイミングの不確かさ下における軌道最適化軌道最適化2024/7/1
接触タイミングの不確かさに対してロバストな制御方策を求める新しい最適制御定式化を提案し、ロコモーションとマニピュレーションの簡易タスクで有効性を示した。
- 効率的な接触計画のための実行可能遷移の学習歩行2024/7/1
四足歩行ロボットが飛び石のような厳しい環境を移動するため、接触遷移の動的実行可能性を学習し、モンテカルロ木探索による接触計画を高速化・高精度化した。
- 学習ベースの脚式移動:最新技術と今後の展望歩行2024/6/1
深層学習やシミュレーション技術の発展により進歩した学習ベースの脚式移動研究を、四足歩行と二足歩行(ヒューマノイド)に分けて概観し、未解決課題と社会的影響を論じたサーベイ。
- 拡散モデルによる接触計画学習で実現する俊敏な跳躍移動歩行2024/3/1
飛び石のような制約環境での俊敏な移動のため、NMPCとMCTSで接触計画を生成し、拡散モデルで目標条件付き方策を学習した。
- Multi-contact Stochastic Predictive Control for Legged Robots with Contact Locations Uncertainty2023/9/1
- Visual-Inertial and Leg Odometry Fusion for Dynamic Locomotion2022/10/1
- Nonlinear Stochastic Trajectory Optimization for Centroidal Momentum Motion Generation of Legged Robots2022/5/1
- On the Use of Torque Measurement in Centroidal State Estimation2022/2/1
- BiConMP: A Nonlinear Model Predictive Control Framework for Whole Body Motion Planning2022/1/1
- A unified framework for walking and running of bipedal robots2021/10/1
- Rapid Convex Optimization of Centroidal Dynamics using Block Coordinate Descent2021/8/1
- Model-free Reinforcement Learning for Robust Locomotion using Demonstrations from Trajectory Optimization2021/7/1
- Impedance Optimization for Uncertain Contact Interactions Through Risk Sensitive Optimal Control2020/11/1
- Efficient Multi-Contact Pattern Generation with Sequential Convex Approximations of the Centroidal Dynamics2020/10/1
- DeepQ Stepper: A framework for reactive dynamic walking on uneven terrain2020/10/1
- Variable Horizon MPC with Swing Foot Dynamics for Bipedal Walking Control2020/10/1
- Robot Learning with Crash Constraints2020/10/1
- Robust walking based on MPC with viability guarantees2020/10/1
- TriFinger: An Open-Source Robot for Learning Dexterity2020/8/1
- Stochastic and Robust MPC for Bipedal Locomotion: A Comparative Study on Robustness and Performance2020/5/1
- An Open Torque-Controlled Modular Robot Architecture for Legged Locomotion Research2019/10/1
- Robust Humanoid Locomotion Using Trajectory Optimization and Sample-Efficient Learning2019/7/1
- Learning Variable Impedance Control for Contact Sensitive Tasks2019/7/1
- Trajectory Optimization for Robust Humanoid Locomotion with Sample-Efficient Learning2019/6/1
- A Whole-Body Model Predictive Control Scheme Including External Contact Forces and CoM Height Variations2018/10/1
- A Reactive and Efficient Walking Pattern Generator for Robust Bipedal Locomotion2017/10/1
- Rigid vs compliant contact: An experimental study on biped walking2017/9/1
- Pattern Generation for Walking on Slippery Terrains2017/8/1
- Walking Control Based on Step Timing Adaptation2017/4/1
- Online Adaptation for Humanoids Walking On Uncertain Surfaces2017/3/1
- Push Recovery of a Humanoid Robot Based on Model Predictive Control and Capture Point2016/12/1
- Step Timing Adjustment: A Step toward Generating Robust Gaits2016/10/1
- Stepping Stabilization Using a Combination of DCM Tracking and Step Adjustment2016/9/1