Junjin Xiao
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 多視点潜在事前分布による行動多様体学習を用いたロボット操作VLA2026/5/1
単眼入力の奥行き曖昧性を解決するため、事前学習済み多視点拡散モデルで潜在的な新視点を合成し、3次元幾何学的ガイダンスで多視点特徴を整列するG3Tと、有効な行動多様体上で直接行動を予測するAMLを提案した。
- ABot-PhysWorld: 物理整合を備えたロボット操作のための対話型世界基盤モデル世界モデル2026/3/1
物理的に不自然な操作動画を生成する問題を解決するため、物理認識アノテーション付きの大規模データセットとDPOベースの後訓練を導入し、物理的に妥当で行動制御可能な動画を生成する世界モデルを提案した。
- ABot-M0: 行動多様体学習によるロボットマニピュレーションのためのVLA基盤モデルVLA2026/2/1
異種ロボットデータを統合した大規模データセットUniACTを構築し、行動が低次元多様体上に存在するという仮説に基づくAction Manifold Learningで効率的なVLA基盤モデルを実現した。
- World-Env: ワールドモデルを仮想環境として活用するVLAポストトレーニングVLA2025/9/1
物理的に整合性のあるワールドモデルを仮想シミュレータとして使い、VLAモデルを強化学習でポストトレーニングする枠組みを提案。タスクごとに5件の実演データだけで複雑なマニピュレーション性能を向上させる。