Puxin Yan
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAワールドモデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HALO: 身体性マルチモーダル連鎖推論のための統合視覚-言語-行動モデルVLA2026/2/1
テキスト推論・視覚的サブゴール予測・行動予測を統合したEM-CoT推論を可能にするVLAモデルHALOを提案し、シミュレーションと実環境でベースラインを上回る性能を示した。
- MIND-V: 物理整合のための強化学習を用いた階層型ワールドモデルによる長期的ロボットマニピュレーションワールドモデル2025/12/1
認知科学に着想を得た階層型ワールドモデルMIND-Vを提案し、物理的に妥当で論理的に一貫した長期的ロボット操作動画を合成する。強化学習による物理整合でSOTAを達成。