Shilong Zou
収録論文 5本 ・ フィジカルAI/ロボット学習
ワールドモデル世界モデルVLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Pelican-Sim 1.0:身体性知能のための汎用ワールドモデルシミュレータワールドモデル2026/9/10
視覚文脈とロボット行動から将来の観測を予測する汎用ワールドモデルシミュレータを提案し、統一行動表現やMoE、効率的なロールアウト生成により行動制御性と映像品質を大幅に向上させた。
- PAIWorld: ロボット操作のための3D整合性を持つ世界基盤モデル世界モデル2026/6/1
複数視点の3D整合性を保つ世界基盤モデルを提案し、ロボット操作のための予測と計画を改善した。
- Pelican-Unify 1.0: 理解・推論・想像・行動を統合した身体化基盤モデルVLA2026/5/1
単一のVLMと統一未来生成器を用いて、理解・推論・想像・行動を一つのモデルで統合的に学習・実行する身体化基盤モデルを提案し、各能力のベンチマークで高い性能を達成した。
- AdaPower: 予測的マニピュレーションのための世界基盤モデルの特化マニピュレーション2025/12/1
汎用世界基盤モデルを推論時適応と記憶持続で軽量に特化させ、事前学習済みVLAを再訓練なしで強化するフレームワークを提案。
- LaDi-WM: 予測的マニピュレーションのための潜在拡散ベース世界モデルマニピュレーション2025/5/1
事前学習済み視覚基盤モデルの潜在空間を拡散モデルで予測する世界モデルを提案し、予測状態を活用した拡散ポリシーによりマニピュレーション性能を大幅に向上させた。