Zhibo Fang
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MT-WAM: 予測表現を行動生成へ再方向づける映像拡散トランスフォーマーVLA2026/9/18
映像拡散トランスフォーマーの単一順伝播表現に、将来の2D点軌跡と視覚特徴の補助監督を加え、行動生成に必要な動態・空間構造を強調する手法を提案。LIBEROで98.2%、LIBERO-Plusで73.7%の成功率を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
映像拡散トランスフォーマーの単一順伝播表現に、将来の2D点軌跡と視覚特徴の補助監督を加え、行動生成に必要な動態・空間構造を強調する手法を提案。LIBEROで98.2%、LIBERO-Plusで73.7%の成功率を達成した。