Yibo Peng
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReFPO: フローマッチングポリシー勾配のためのリフロー正則化強化学習/生成ポリシー2026/6/1
フローマッチングポリシー勾配法に明示的なリフロー正則化を追加したオンライン強化学習手法を提案し、生成ポリシーの学習安定性と性能を向上させた。
- ExoActor: 外観視点ビデオ生成による汎用的な対話型ヒューマノイド制御ヒューマノイド制御2026/4/1
大規模ビデオ生成モデルを活用し、第三者の視点からのビデオ生成をインターフェースとして、ロボットと環境・物体の相互作用をモデル化し、ヒューマノイドの行動制御を実現するフレームワークを提案した。
- DECO: 触覚アダプタを備えた双腕巧み操作のための分離型マルチモーダル拡散トランスフォーママニピュレーション2026/2/1
視覚・固有感覚・触覚を分離した条件付け経路で統合する拡散トランスフォーマDECOを提案し、双腕巧み操作の触覚データセットDECO-50を公開。実機実験で成功率72.25%を達成し、触覚アダプタが複雑な接触タスクで20%向上。
- MOSAIC: 高速残差適応による汎用人型モーション追従と遠隔操作のsim-to-realギャップの橋渡しsim2real2026/2/1
多様な入力インターフェースに対応する人型ロボットの全身遠隔操作システムを構築し、インターフェース固有の残差モジュールを高速適応・蒸留することで、実機での長期的な遠隔操作を安定化させた。
- RoboMirror: 模倣の前に理解する、動画からヒューマノイド歩行への変換VLA2025/12/1
VLMを用いて動画から視覚的な運動意図を抽出し、拡散ポリシーを条件付けることで、ポーズ再構成やリターゲティングなしにヒューマノイドの歩行を生成するフレームワークを提案。
- フリースタイルはできる?音声制御による表現豊かなヒューマノイド歩行歩行2025/12/1
音声から直接ヒューマノイドのダンスや身振りを生成する統一フレームワークRoboPerformを提案し、低遅延で高忠実な音声同期動作を実現した。
- 言語から運動へ:動作潜在ガイダンスによるリターゲティング不要なヒューマノイド制御VLA2025/10/1
言語指示から直接ヒューマノイドの動作を生成するフレームワークRoboGhostを提案し、従来の動作デコード・リターゲティングを省略して低遅延かつ高精度な制御を実現した。
- RoboSeek: 物体と対話しながら学ぶロボットマニピュレーションマニピュレーション2025/9/1
3D再構成で実環境をシミュレーションに再現し、強化学習とクロスエントロピー法で方策を訓練、real2sim2real転移で実機に展開する長期マニピュレーションの枠組みを提案。
- RobotDancing: 残差行動強化学習によるロバストな長時間ヒューマノイド動作追従ヒューマノイド動作追従2025/9/1
参照動作に対する残差関節目標を強化学習で予測し、参照とロボットの動力学の不一致を補償することで、ヒューマノイドの長時間・高ダイナミックな動作追従を実現した。