Xue Bin Peng
収録論文 39本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ゲーム誘導型スキル発見:自己対戦による操作可能なエージェント制御スキル発見2026/9/30
ゲーム内の自己対戦を利用して、人間が直接操作できる意味的に異なる運動スキルを発見する枠組みを提案し、Ant・Frankaアーム・Unitree G1で未学習タスクを人間がスキルを組み合わせて解けることを示した。
- 拡散モデルによる多様で再利用可能な運動スキルの発見スキル発見2026/9/15
拡散モデルで状態分布のエントロピー勾配を推定し、高次元ヒューマノイド制御において多様で再利用可能な運動スキルを獲得する手法を提案。
- MotionBricks: モジュール型潜在生成モデルとスマートプリミティブによるスケーラブルなリアルタイムモーション生成モーション生成2026/4/1
大規模なモーション生成をリアルタイムで行うためのフレームワークを提案し、35万以上のモーションクリップを単一モデルで扱い、速度指令やスタイル選択などの細かい制御を可能にするスマートプリミティブを導入した。
- モーション生成とモーショントラッキングによる全身ヒューマノイド歩行の学習歩行2026/4/1
参照モーションから学習した全身スキルと地形認識適応を組み合わせたヒューマノイド歩行フレームワークを提案し、実機で箱や階段などの複合地形を踏破できることを示した。
- Kimodo: 制御可能な人間動作生成のスケーリング動作生成2026/3/1
700時間の光学モーションキャプチャデータで訓練した、テキストやキネマティック制約で制御可能な高品質な人間動作生成モデルを提案した論文。
- SMP: 物理ベースキャラクター制御のための再利用可能なスコアマッチング動作事前分布キャラクター制御2025/12/1
事前学習済み動作拡散モデルとスコア蒸留サンプリングを活用し、タスクに依存せず再利用可能な動作事前分布を構築する手法を提案。凍結したまま汎用報酬関数として新規ポリシーの学習に再利用でき、スタイル合成も可能。
- MimicKit: 動作模倣と制御のための強化学習フレームワーク動作模倣2025/10/1
動作模倣と強化学習を用いた動作コントローラの学習を統合的に行えるオープンソースフレームワークを提供し、モジュール性と拡張性を高めた。
- ノイズを考慮した生成的顕微鏡交通シミュレーション交通シミュレーション2025/8/1
インフラカメラ由来のノイズを含む車両軌跡データセットI24-MSDを構築し、ノイズを学習問題の一部として扱う生成的交通シミュレーションモデルを提案した論文。
- LeVERB: 潜在視覚言語指示によるヒューマノイド全身制御VLA2025/6/1
ヒューマノイドの全身制御向けに、視覚言語ポリシーが潜在的な行動語彙を学習し、強化学習ベースの全身制御ポリシーがそれを実行する階層型フレームワークを提案。150以上のタスクを含む初のsim-to-real対応ベンチマークで評価し、単純な階層型VLAより7.8倍高い成功率を達成。
- GMT: ヒューマノイド全身制御のための汎用動作追従全身制御2025/6/1
多様な全身動作を実世界で追従できるよう、適応的サンプリングと動作Mixture-of-Expertsを組み合わせた単一の汎用方策を学習するフレームワークを提案。
- 全身マニピュレーションを実現する汎用生成制御ポリシーマニピュレーション2025/5/1
大規模モーションキャプチャから蒸留した生成制御ポリシーにより、目標物体姿勢や身体姿勢を指定するだけで全身を使った多様な物体操作動作を物理シミュレーション上で生成する手法を提案。
- 敵対的差分識別器による物理ベースの動作模倣動作模倣2025/5/1
手動設計の報酬関数を使わず、単一の正例から学ぶ敵対的差分識別器で物理シミュレーション上のキャラクターの多様なアクロバティック動作を高精度に模倣する手法を提案。
- PARC: 強化学習と物理シミュレーションによるキャラクターコントローラのための動作データ拡張歩行2025/5/1
少数のモーションデータから生成器と物理ベース追従コントローラを反復的に学習させ、地形走破動作を拡張するフレームワークPARCを提案。
- TWIST: 遠隔操作による全身模倣システム全身遠隔操作2025/5/1
人間のモーションキャプチャを人型ロボットに再ターゲティングし、強化学習と行動クローニングを組み合わせた単一のニューラルネットワーク制御器で、全身の協調動作を実現する遠隔操作システムを開発した。
- ヒューマノイドの移動と操作:制御・計画・学習の現状と課題ヒューマノイド2025/1/1
ヒューマノイドロボットの移動と操作に関する研究を、モデルベース手法と学習ベース手法の両面から包括的にサーベイし、触覚や基盤モデル統合の可能性と課題を整理した。
- Lipschitz制約付きポリシーによる滑らかなヒューマノイド歩行の学習歩行2024/10/1
方策にLipschitz制約を勾配ペナルティとして課すことで、低域通過フィルタや平滑化報酬を使わずに滑らかで頑健なヒューマノイド歩行制御を学習する手法を提案し、実機で検証した。
- 3D拡散ポリシーによる汎化可能なヒューマノイドマニピュレーションマニピュレーション2024/10/1
上半身テレオペで収集した単一場面のデータと機載計算のみで、25自由度ヒューマノイドが多様な実環境で自律マニピュレーションを実現するシステムを構築した。
- MaskedMimic: マスク付きモーションインペインティングによる統一的な物理ベースキャラクタ制御物理ベースキャラクタ制御2024/9/1
部分的なモーション記述(キーフレーム、テキスト、物体など)から物理シミュレーション上のキャラクタ動作を生成する単一の統合モデルを提案。
- HiLMa-Res: 残差強化学習による四脚ロボットの移動と操作を統合する汎用階層フレームワーク移動操作2024/7/1
四脚ロボットが歩行しながら脚で操作を行うための階層型強化学習フレームワークを提案し、実機で複数の移動操作タスクにおいて既存手法より優れた性能を示した。
- 言語ガイド付きスキル発見スキル発見2024/6/1
大規模言語モデルの意味知識を活用し、ユーザープロンプトに基づいて意味的に多様なスキルを発見するフレームワークを提案。脚ロボットやマニピュレーションで有効性を示した。
- DiffuseLoco: オフラインデータセットからの拡散モデルによるリアルタイム脚式移動制御歩行2024/4/1
オフラインデータセットから拡散モデルを用いて多様な脚式移動スキルを学習し、実機の四足ロボットでリアルタイム制御とゼロショット転移を実現したフレームワーク。
- Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control2024/1/1
- Trajeglish: Traffic Modeling as Next-Token Prediction2023/12/1
- CALM: Conditional Adversarial Latent Models for Directable Virtual Characters2023/5/1
- Trace and Pace: Controllable Pedestrian Animation via Guided Trajectory Diffusion2023/4/4
- RoboPianist: Dexterous Piano Playing with Deep Reinforcement Learning2023/4/1
- Learning and Adapting Agile Locomotion Skills by Transferring Experience2023/4/1
- Robust and Versatile Bipedal Jumping Control through Reinforcement Learning2023/2/1
- PADL: Language-Directed Physics-Based Character Control2023/1/31
- Creating a Dynamic Quadrupedal Robotic Goalkeeper with Reinforcement Learning2022/10/1
- GenLoco: Generalized Locomotion Controllers for Quadrupedal Robots2022/9/1
- Hierarchical Reinforcement Learning for Precise Soccer Shooting Skills using a Quadrupedal Robot2022/8/1
- Adversarial Motion Priors Make Good Substitutes for Complex Reward Functions2022/3/1
- Legged Robots that Keep on Learning: Fine-Tuning Locomotion Policies in the Real World2021/10/1
- Reinforcement Learning for Robust Parameterized Locomotion Control of Bipedal Robots2021/3/1
- Learning Agile Robotic Locomotion Skills by Imitating Animals2020/4/1
- Terrain RL Simulator2018/4/1
- Sim-to-Real Transfer of Robotic Control with Dynamics Randomization2017/10/1
- Learning Locomotion Skills Using DeepRL: Does the Choice of Action Space Matter?2016/11/1