Yuzhong Zhao
University of Chinese Academy of Sciences
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 時間的強制:視覚・言語・行動モデルのための4D表現アライメントVLA2026/8/31
VLAモデルに履歴パスを導入し、4D基盤モデルの幾何特徴と整列させることで、時間情報を活用した操作性能を向上させた。
- Mind-VLA: 指示認識型空間表現アライメントによる視覚言語行動モデルVLA2026/8/1
言語指示で指定された対象物体の3D幾何に焦点を当て、VLAモデルの表現をアライメントする手法を提案。LIBEROやCALVINで高精度を達成し、実ロボットの遮蔽タスクでも大幅な性能向上を示した。