Yifu Yuan
収録論文 19本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WarpSAC: 探索と活用の再考によるスケーラブルなオフ方策強化学習の頂点を目指して強化学習2026/8/25
データ量に応じて安定化手法を適応させるオフ方策RLアルゴリズムWarpSACを提案し、CPU/GPU並列環境で既存手法を大幅に上回る性能を達成した。
- Hy-Embodied-VLM-1.0:効率的な物理世界エージェントVLA2026/7/14
物理世界で動作する組み込みエージェント向けの基盤モデルを提案し、行動中心の能力分類に基づくデータパイプラインと効率的なMoEアーキテクチャにより、38ベンチマークで優れた性能を達成した。
- RoboPIN: ピン留めチェーン・オブ・ソートによる接地された身体化推論身体化推論/VLM2026/6/14
身体化推論の各ステップを視覚的証拠に固定する「ピン留めチェーン・オブ・ソート」を提案し、エンティティ追跡の一貫性を保つデータセットとモデルを構築した。
- Embodied-R1.5:身体化基盤モデルによる物理的知能の進化身体化基盤モデル2026/6/1
身体化された認知・計画・修正・指示を統合した基盤モデルを構築し、大規模データとマルチタスク強化学習で身体化VLMのSOTAを達成。さらに少量データでVLAに転移可能なことを示した。
- RIO: クロスエンボディメントロボット学習のための柔軟なリアルタイムロボットI/Oロボット学習基盤2026/5/1
多様なロボットハードウェアと形態に対応した、柔軟で軽量なロボット制御・遠隔操作・データ整形・センサ設定・ポリシー展開のためのオープンソースPythonフレームワークを提案し、VLAモデルの展開と微調整を実証した。
- ForceFlow: 接触駆動フローマッチングによる感覚と行動の学習マニピュレーション2026/5/1
接触を伴う操作タスクのための力覚対応リアクティブフレームワークを提案。非対称マルチモーダル融合と視覚から力へのハンドオーバー機構により、力と運動の深い結合を実現し、実世界6タスクで成功率を37%向上させた。
- RPL: 複雑地形におけるロバストな人型知覚移動の学習歩行2026/2/1
2段階の学習フレームワークにより、複数の深度カメラを用いて複雑な地形を多方向に歩行し、荷物を積んでもロバストな人型ロボットの移動を実現した。
- ActionCodec:優れたアクショントークナイザの設計原則VLA2026/2/1
VLA最適化の観点から情報理論に基づく設計原則を導き、それに従う高性能アクショントークナイザActionCodecを提案。LIBEROでロボティクス事前学習なしにSOTAを達成。
- Embodied Arena:具現化AIのための包括的・統合・進化型評価プラットフォーム評価基盤2025/9/1
具現化AIの能力を3階層・7能力・25次元で体系化し、22のベンチマークと30以上のモデルを統合評価する進化型プラットフォームを構築した。
- Embodied-R1: 汎用ロボット操作のための強化学習による身体性推論VLA2025/8/1
「ポインティング」を身体性に依存しない中間表現として用い、3Bの視覚言語モデルを強化学習ファインチューニングで訓練することで、未知の環境や実機タスクへのゼロショット汎化を実現した研究。
- 見ることから行うことへ:ロボットマニピュレーションのための推論と意思決定の橋渡しマニピュレーション2025/5/1
空間関係推論で中間表現を生成する視覚言語モデルFSDを提案し、ロボット操作のゼロショット性能を大幅に向上させた。
- FALCON: 力適応型ヒューマノイド移動操作の学習移動操作2025/5/1
下半身と上半身を別々の強化学習エージェントで制御し、力のカリキュラム学習で外力に適応するヒューマノイドの移動操作フレームワークを提案。実機で荷物運搬やカート牽引、ドア開けを実現した。
- EmbodiedMAE: ロボットマニピュレーションのための統合3Dマルチモーダル表現マニピュレーション2025/5/1
RGB・深度・点群を統合的に学習するマルチモーダルMAEを提案し、DROID-3Dデータセットで訓練することで、シミュレーションと実機の操作タスクにおいて既存の視覚基盤モデルを上回る性能を達成した。
- AhaRobot:身体性AIのための低コストオープンソース双腕移動マニピュレータマニピュレーション2025/3/1
低コストで完全オープンソースの双腕移動マニピュレータを開発し、遠隔操作インターフェースと制御スタックを最適化することで、家庭内タスクの模倣学習を可能にした。
- CleanDiffuser: 意思決定のための拡散モデル向け使いやすいモジュール式ライブラリ拡散モデル意思決定2024/6/1
意思決定アルゴリズムに特化した初の拡散モデルライブラリCleanDiffuserを提案し、モジュール式で柔軟な実装と広範な評価を通じてその信頼性と設計上の知見を示した。
- Enhancing Robotic Manipulation with AI Feedback from Multimodal Large Language Models2024/2/1
- Uni-RLHF:多様な人間フィードバックを用いた強化学習のための汎用プラットフォームとベンチマークスイートRLHF2024/2/1
多様な人間フィードバックを扱うRLHFのための注釈プラットフォーム、大規模クラウドソーシングデータセット、モジュール式オフラインRLHFベースラインを提供する統合システムを構築し、30以上のタスクで1500万ステップを超えるデータを収集して評価した。
- EUCLID: Towards Efficient Unsupervised Reinforcement Learning with Multi-choice Dynamics Model2022/10/1
- SAPIEN: A SimulAted Part-based Interactive ENvironment2020/3/1