Mingfei Chen
収録論文 2本 ・ フィジカルAI/ロボット学習
世界モデル手軌道予測
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ThinkJEPA:大規模視覚言語推論モデルで潜在世界モデルを強化世界モデル2026/3/1
VLMの長期的な意味推論とJEPAの密な動力学モデリングを二重時間経路で統合し、手の操作軌道予測の精度を向上させた研究。
- 推論から動作へ流れる:一人称視点の人間インタラクション動画から3D手軌道予測を学習手軌道予測2025/12/1
一人称視点のインタラクション動画を用いて、視覚言語推論と動作生成を軌道トークンで結びつけ、段階を考慮した3D手軌道を予測するフレームワークを提案。大規模データセットEgoMANも構築。