Mingyuan Jia
COCO Matrix
収録論文 5本 ・ フィジカルAI/ロボット学習
マニピュレーションワールドモデル世界モデル3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 世界行動モデルを再考する:構成的・文脈内ロボットマニピュレーションに向けてマニピュレーション2026/10/1
操作タスクを視覚サブゴール計画と実行に階層化し、事前学習済み世界モデル表現を共有するViGARを提案。長期構成的タスクと文脈内学習で高い成功率を示した。
- 前方予測だけで十分か?JEPAワールドモデルのための物理状態接地ワールドモデル2026/8/1
JEPAベースのワールドモデルに、ロボットの自己受容状態と関節角変化を接地する2つの目的を追加し、潜在表現の識別性と下流タスク性能を向上させる手法を提案した。
- Worldscape-MoE: スケーラブルな異種行動制御のための統一Mixture-of-Experts世界モデル世界モデル2026/7/1
異なる行動モダリティ(カメラ軌道、ロボット動作、手の関節信号など)を統一的に扱える拡張可能な世界モデルを提案し、MoEアーキテクチャにより異種の行動制御を共有の世界ダイナミクスに統合する。
- ReplicateAnyScene: テキスト・視覚・空間の整合によるゼロショット動画から3Dシーンへの構成3D再構成2026/4/12
動画から自動で物体を分割し、3Dシーンとして構成するフレームワークを提案。手動プロンプトや追加視覚入力なしで、テキスト・視覚・空間の事前知識を統合し、高品質な構成3Dシーンを生成する。
- AirScape: 運動制御可能な空中生成ワールドモデル世界モデル2025/7/1
6自由度ドローンの視覚入力と運動意図から将来の観測を予測する世界モデルを構築し、運動意図に沿った3D空間想像力で既存モデルを大幅に上回った。