Gaoyue Zhou
収録論文 10本 ・ フィジカルAI/ロボット学習
VLA世界モデル/表現学習マニピュレーションナビゲーション/世界モデルワールドモデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- パッチポリシー:高密度視覚表現による効率的な身体制御VLA2026/7/1
Vision Transformerの事前学習済みパッチ特徴を直接利用する軽量なロボットポリシーを提案し、グローバル表現や大規模VLAを凌ぐ性能を達成した。
- 潜在計画のための時間的直線化世界モデル/表現学習2026/3/12
世界モデルを用いた潜在計画のための表現学習を改善する手法を提案。人間の視覚処理における知覚的直線化仮説に着想を得て、曲率正則化により潜在軌道を局所的に直線化し、計画の安定性と成功率を向上させる。
- 人間の動画から巧みな手と物体の相互作用を学習する世界モデルマニピュレーション2025/12/1
一人称視点の人間動画から指のキーポイントを抽出し、巧みな手の動作を予測する世界モデルDexWMを提案。補助的な手の一貫性損失により、Franka PandaとAllegroグリッパーでのゼロショット転移でDiffusion Policyを50%以上上回る。
- ナビゲーション世界モデルナビゲーション/世界モデル2024/12/1
人間とロボットの視点動画で学習した10億パラメータの拡散トランスフォーマーにより、過去の観測と行動から将来の視覚像を予測し、ナビゲーション経路を計画するモデルを提案した。
- DINO-WM: 事前学習済み視覚特徴量上のワールドモデルによるゼロショット計画ワールドモデル2024/11/1
DINOv2のパッチ特徴量を予測するワールドモデルをオフライン軌道から学習し、行動列最適化により未見タスクをゼロショットで計画する手法を提案。
- RoboHive: A Unified Framework for Robot Learning2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Train Offline, Test Online: A Real Robot Learning Benchmark2023/6/1
- Real World Offline Reinforcement Learning with Realistic Data Source2022/10/1
- Parrot: Data-Driven Behavioral Priors for Reinforcement Learning2020/11/1