Yifeng Zhu
収録論文 24本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IMPASTO: モデルベース計画と学習された力学モデルを統合したロボット油絵再現ロボットアート/計画2026/3/1
ロボットが油絵の画像列から筆の軌道や力、色を推論して再現するシステムを提案。学習したピクセル力学モデルとモデル予測制御を統合し、自己対戦のみで学習する。
- LLM-GROP: 大規模言語モデルによる視覚に基づくロボットのタスク・動作計画タスク・動作計画2025/11/1
大規模言語モデルの常識知識と視覚情報を活用し、複数物体の移動を伴うモバイルマニピュレーションのタスク・動作計画を統合するフレームワークを提案。実環境とシミュレーションで成功率と効率を評価した。
- RoboSSM: 状態空間モデルによるスケーラブルな文脈内模倣学習模倣学習2025/9/1
Transformerの代わりに状態空間モデル(Longhorn)を用いた文脈内模倣学習手法を提案し、長い文脈のプロンプトでも効率的に推論できることを示した。
- ComposableNav: 合成可能な拡散モデルによる動的環境での指示追従ナビゲーションナビゲーション2025/9/1
拡散モデルで各動作プリミティブを個別に学習し、展開時に並列合成することで、訓練で見ていない指示の組み合わせにも対応できるナビゲーション手法を提案。
- SocialNav-SUB: ソーシャルロボットナビゲーションにおけるシーン理解のためのVLMベンチマークVLA2025/9/1
ソーシャルロボットナビゲーションの実世界シーン理解を評価するVQAデータセットとベンチマークを提案し、最先端VLMが人間やルールベース手法に及ばないことを示した。
- LodeStar: 人間のデモンストレーションからの合成データ拡張による長期的器用操作マニピュレーション2025/8/1
人間のデモを基礎モデルでスキルに分解し、強化学習で合成データを生成して、長期的な器用操作を実現する学習フレームワークを提案。
- オープンワールドロボット操作のための効率的な感覚運動学習マニピュレーション2025/5/1
限られたデモデータから規則性を活用し、新しい物体やタスクに適応できる汎用的な操作スキルを効率的に学習する手法を提案する論文。
- Harmon: 言語記述からヒューマノイドの全身運動を生成全身運動生成2024/10/1
人間の運動データを事前知識として活用し、視覚言語モデルの常識推論で編集・洗練することで、言語指示に沿った自然で多様なヒューマノイド全身運動を生成する手法を提案した。
- OKAMI: 単一動画の模倣によるヒューマノイドロボットの操作スキル学習模倣学習/ヒューマノイド2024/10/1
1本のRGB-D動画から物体を認識して人間の動きをヒューマノイドに再ターゲティングし、操作計画と実行ポリシーを生成する手法を提案。閉ループ視覚運動ポリシーは79.2%の成功率を達成した。
- BUMBLE: 視覚言語モデルによる建物全体の移動マニピュレーションのための推論と行動の統合移動マニピュレーション2024/10/1
建物規模の長期的な移動マニピュレーションタスクに取り組むため、視覚言語モデルを基盤に開放世界RGBD知覚、粗から細への運動スキル、二層メモリを統合したフレームワークBUMBLEを提案し、70試行で平均47.1%の成功率を達成した。
- 単一の人間動画とオープンワールド物体グラフからの視覚ベースマニピュレーション模倣学習2024/5/1
1本の人間のRGB/RGB-D動画から物体中心の操作計画を抽出し、それを条件とする方策を学習することで、未知物体や背景・視点の変化に対応できる模倣学習手法ORIONを提案した。
- InterPreT: 言語フィードバックからの対話的述語学習による汎化可能なタスクプランニングタスクプランニング2024/5/1
人間の非専門家による言語フィードバックから記号述語と作用素を学習し、PDDLに変換してロボットの長期タスクプランニングを実現するLLMベースのフレームワーク。
- LOTUS: Continual Imitation Learning for Robot Manipulation Through Unsupervised Skill Discovery2023/11/1
- Learning Generalizable Manipulation Policies with Object-Centric 3D Representations2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Symbolic State Space Optimization for Long Horizon Mobile Manipulation Planning2023/7/1
- VIOLA: Imitation Learning for Vision-Based Manipulation with Object Proposal Priors2022/10/1
- Learning to Walk by Steering: Perceptive Quadrupedal Locomotion in Dynamic Environments2022/9/1
- Visually Grounded Task and Motion Planning for Mobile Manipulation2022/2/1
- Bottom-Up Skill Discovery from Unsegmented Demonstrations for Long-Horizon Robot Manipulation2021/9/1
- Synergies Between Affordance and Geometry: 6-DoF Grasp Detection via Implicit Representations2021/4/1
- Hierarchical Planning for Long-Horizon Manipulation with Geometric and Symbolic Scene Graphs2020/12/1
- Fast Uncertainty Quantification for Deep Object Pose Estimation2020/11/1
- robosuite: A Modular Simulation Framework and Benchmark for Robot Learning2020/9/1