Ye Yuan
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AdaOcc: 身体性タスクのための適応的3D占有予測3D占有予測2026/9/30
様々なセンサ構成や計算予算に適応できる、点ベースの3D意味占有予測手法AdaOccを提案し、Occ-ScanNetで最先端性能を達成した。
- 潜在進化を明示する:ワールドアクションモデルのための演算子構造化遷移VLA2026/8/27
ロボット政策のためのワールドアクションモデルにおいて、潜在空間の遷移を演算子ベースで構造化するLEONを提案し、閉ループ性能と頑健性を向上させた。
- DA-Nav: 方向認識型の都市規模視覚言語ナビゲーションナビゲーション2026/7/1
市街地規模の屋外ナビゲーションを、商用ナビの方向指示を利用して、自己中心視画像上の離散的な空間接地問題として再構成し、軌道回復を可能にするフレームワークを提案した。
- GRAIL: 3Dアセットとビデオ事前知識から人型ロコ操作を生成ロコ操作2026/6/1
物理環境や遠隔操作を必要とせず、3Dアセットとビデオ基盤モデルの事前知識を用いて、人型ロボットの全身操作デモを仮想的に生成するパイプラインを提案した。
- MotionBricks: モジュール型潜在生成モデルとスマートプリミティブによるスケーラブルなリアルタイムモーション生成モーション生成2026/4/1
大規模なモーション生成をリアルタイムで行うためのフレームワークを提案し、35万以上のモーションクリップを単一モデルで扱い、速度指令やスタイル選択などの細かい制御を可能にするスマートプリミティブを導入した。
- Kimodo: 制御可能な人間動作生成のスケーリング動作生成2026/3/1
700時間の光学モーションキャプチャデータで訓練した、テキストやキネマティック制約で制御可能な高品質な人間動作生成モデルを提案した論文。
- CHIP: 後知恵摂動によるヒューマノイドの適応的コンプライアンス制御マニピュレーション2025/12/1
後知恵摂動を用いて、動的動作の追従性を保ちながらエンドエフェクタの硬さを調整可能にするプラグアンドプレイモジュールCHIPを提案し、力強いマニピュレーションタスクを実現した。
- SONIC: 自然なヒューマノイド全身制御のための運動追跡の超大規模化ヒューマノイド制御2025/11/1
運動追跡をスケーラブルなタスクと位置づけ、モデル容量・データ・計算量を大規模化することで、自然で堅牢な全身運動が可能な汎用ヒューマノイド制御器を構築した研究。
- VIRAL: ヒューマノイドの移動操作に向けた大規模視覚Sim-to-Realsim2real2025/11/1
シミュレーションのみでヒューマノイドの移動を伴う操作スキルを学習し、実機にゼロショット転移する視覚ベースのフレームワークを提案。大規模ドメインランダム化と実機整合により、Unitree G1上で連続的な移動操作を実現した。
- ヒューマノイドロボットの顔面感情表現の覚醒表情生成2025/10/1
生体模倣型のロボット顔とKAN・注意機構による学習フレームワークを構築し、表情模倣を自動獲得する手法を提案。ヒューマノイドロボット向け初のオープンソース表情データセットも公開した。
- 視覚強化学習から創発するシミュレーション人型ロボットの能動的知覚と器用さVLA2025/5/1
自己中心視覚のみを入力とする強化学習フレームワークPDCを提案し、シミュレーション人型ロボットが物体探索・把持・配置・関節物体操作などの家事タスクを単一ポリシーで遂行できることを示した。
- GENMO: 人間の動作のための汎用モデル動作生成・推定2025/5/1
動作生成と動作推定を単一の枠組みに統合した汎用モデルGENMOを提案。動作推定を制約付き動作生成として再定式化し、回帰と拡散の相乗効果で高精度な推定と多様な生成を両立する。
- Harmon: 言語記述からヒューマノイドの全身運動を生成全身運動生成2024/10/1
人間の運動データを事前知識として活用し、視覚言語モデルの常識推論で編集・洗練することで、言語指示に沿った自然で多様なヒューマノイド全身運動を生成する手法を提案した。
- SMPLOlympics:物理シミュレーションされたヒューマノイドのためのスポーツ環境ヒューマノイド制御2024/7/1
人間の動作データと互換性のあるヒューマノイドモデルを用いて、ゴルフやテニスなど多様なオリンピック競技を物理シミュレーションで再現する環境群を構築し、強力な動作事前分布と単純な報酬の組み合わせで人間らしいスポーツ行動が学習できることを示した。
- Trace and Pace: Controllable Pedestrian Animation via Guided Trajectory Diffusion2023/4/4
- RGB-Only Reconstruction of Tabletop Scenes for Collision-Free Manipulator Control2022/10/1
- Novel total hip surgery robotic system based on self-localization and optical measurement2022/6/1
- Unified Simulation, Perception, and Generation of Human Behavior2022/4/1
- GLAMR: Global Occlusion-Aware Human Mesh Recovery with Dynamic Cameras2021/12/1
- Transform2Act: Learning a Transform-and-Control Policy for Efficient Agent Design2021/10/1
- Dynamics-Regulated Kinematic Policy for Egocentric Pose Estimation2021/6/1
- AgentFormer: Agent-Aware Transformers for Socio-Temporal Multi-Agent Forecasting2021/3/1
- End-to-End 3D Multi-Object Tracking and Trajectory Forecasting2020/8/1
- Residual Force Control for Agile Human Behavior Imitation and Extended Motion Synthesis2020/6/1
- Optical Non-Line-of-Sight Physics-based 3D Human Pose Estimation2020/3/1
- PTP: Parallelized Tracking and Prediction with Graph Neural Networks and Diversity Sampling2020/3/1
- Diverse Trajectory Forecasting with Determinantal Point Processes2019/7/1
- Ego-Pose Estimation and Forecasting as Real-Time PD Control2019/6/1
- Interactive Co-Design of Form and Function for Legged Robots using the Adjoint Method2018/1/1