Zezhi Tang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/蒸留VLAVLA/手話認識/ロボット操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- WAM-OPD: ワールドアクションモデルのためのオンポリシー蒸留VLA/蒸留2026/8/23
ビデオ生成とロボット動作生成を統合したワールドアクションモデル(WAM)の蒸留後性能低下を、オンポリシー蒸留で修復する手法を提案。学生モデルが環境で行動し、教師モデルがその履歴に基づいてビデオと動作のターゲットを提供することで、タスク成功率が大幅に向上した。
- ガイド付きアクションフロー:フローマッチング型視覚言語行動ポリシーのためのQガイド推論VLA2026/7/1
事前学習済みのフローマッチング型VLAポリシーを凍結したまま、学習済みのアクション批評家を用いて推論時にサンプリングをガイドし、ロボット操作の成功率を向上させる手法を提案した。
- SignVLA: 注意機構付きLSTMと視覚-言語-行動モデルによるリアルタイム手話ガイド型ロボット操作VLA/手話認識/ロボット操作2026/6/1
手話をリアルタイムで認識し、ロボット操作の指示に変換するVLAフレームワークを提案。聴覚障害者などへのアクセシビリティ向上を目指す。
- SignVLA: 手話によるロボット操作を実現するグロス不要の視覚言語行動フレームワークVLA2026/2/1
手話のグロス注釈を必要とせず、指文字のジェスチャーを直接ロボットの動作指令に変換するリアルタイムVLAシステムを提案した。
- Real-time object detection and robotic manipulation for agriculture using a YOLO-based learning approach2024/1/1
- Discrete-Time Stress Matrix-Based Formation Control of General Linear Multi-Agent Systems2024/1/1