Wen Chen
Ola Dimensions
収録論文 10本 ・ フィジカルAI/ロボット学習
所属歴(論文より): Ola Dimensions(〜2026) / The Hong Kong University of Science and Technology (Guangzhou)(〜2026)
VLAワールドモデルVLA/クロス身体操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SG-WAM: テキスト接地と空間認識を備えた意味的ガイダンスによる世界行動モデルVLA2026/8/9
世界行動モデル(WAM)の将来ビデオ生成と行動予測を言語指示に整合させるため、VLMベースのプランナーで意味的先見を生成し、それを高レベルな意味的ガイダンスとして注入する手法を提案。シミュレーションと実世界で精度と指示追従性を実証。
- 前方予測だけで十分か?JEPAワールドモデルのための物理状態接地ワールドモデル2026/8/7
JEPAベースのワールドモデルに、ロボットの自己受容状態と関節角変化を接地する2つの目的を追加し、潜在表現の識別性と下流タスク性能を向上させる手法を提案した。
- DyPES-VLA: 共有ダイナミクス事前分布と身体特化制御の学習によるクロス身体操作VLA/クロス身体操作2026/8/6
異なるロボット身体間で共有できるダイナミクス事前分布を学習し、身体ごとの専門家ネットワークで直接制御するVLAモデルを提案。手動の行動形式変換を不要にし、シミュレーションと実機で最高性能を達成した。
- DreamTrajectory: Trajectory-Guided Action Generation with World Model Alignment for Mobile Manipulation2026/8/1
- SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models2026/8/1
- Is Forward Prediction Enough? Physical State Grounding for JEPA World Models2026/8/1
- DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation2026/8/1
- DFM-VLA: Iterative Action Refinement for Robot Manipulation via Discrete Flow Matching2026/3/1
- POIROT: Investigating Direct Tangible vs. Digitally Mediated Interaction and Attitude Moderation in Multi-party Murder Mystery Games2026/3/1
- ETP-R1: Evolving Topological Planning with Reinforcement Fine-tuning for Vision-Language Navigation in Continuous Environments2025/12/1