Yiming Zeng
Peking University
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HIL-UMI: ユニバーサルマニピュレーションインターフェースへのVLAモデルのヒューマン・イン・ザ・ループ事後学習の導入VLA2026/9/17
ロボットを使わずにハンドヘルドUMIデモ中に方策を照会し、Energy Scoreで分布外状態を検出してデータ収集を促し、アドバンテージ推定器を更新してVLAモデルを事後学習する枠組みを提案。
- X-NavDP: グループQスコア再重み付けマッチングによる新規行動と異種エンボディメントへのナビゲーション拡散ポリシーの一般化ナビゲーション2026/7/1
ナビゲーション拡散ポリシーを強化学習で事後訓練し、多様なロボット形態や困難なシナリオへの一般化を向上させるフレームワークGQRMを提案。シミュレーションと実世界で成功率を大幅に改善した。
- フィッシャー保存ガイダンス:安全な拡散制御のための学習不要の多様体制約拡散モデル/ナビゲーション/制御2026/5/1
拡散モデルによる軌道予測で、学習データの多様体から外れる更新を防ぐ学習不要の推論手法を提案し、ナビゲーションや操作タスクで性能を向上させた。
- STRNet: 動的グラフ集約による時空間表現を用いた視覚ナビゲーション視覚ナビゲーション2026/4/1
視覚ナビゲーションのための時空間表現フレームワークを提案し、画像シーケンスと目標画像の特徴を融合して、空間グラフ推論と時間的ダイナミクスモデリングによりナビゲーション性能を向上させた。
- RAPID Hand:汎用ロボット自律性のための堅牢・低コスト・知覚統合型巧みな操作プラットフォームマニピュレーション2025/6/1
低コストで高自由度な多指ハンドと、触覚・視覚・固有感覚を統合した知覚系、高自由度テレオペレーションを共同設計し、高品質な操作データを収集できるプラットフォームを提案。
- NaviDiffusor: コスト誘導拡散モデルによる視覚ナビゲーション視覚ナビゲーション2025/4/1
RGB画像のみから経路を生成する条件付き拡散モデルに、シーンやタスクのコスト勾配を推論時に与えて誘導することで、再学習なしに未知環境へゼロショット適応できる視覚ナビゲーション手法を提案した。
- 事前分布は重要:デノイジング拡散ブリッジモデルによる視覚ナビゲーション視覚ナビゲーション2025/4/1
ガウスノイズではなく情報を持つ事前行動から拡散ブリッジで行動生成を開始することで、視覚ナビゲーションの模倣学習を効率化・高精度化する手法NaviBridgerを提案。
- OPG-Policy: アモーダルセグメンテーションを用いた遮蔽下のプッシュ・グラスプ方策学習マニピュレーション2025/3/1
遮蔽された対象物の見えない部分をアモーダルセグメンテーションで予測し、プッシュと把持の動作を深層Q学習で計画する方策を提案。散らかった環境での把持成功率と動作効率を向上させた。
- LVDiffusor: Distilling Functional Rearrangement Priors from Large Models into Diffusor2023/12/1