Zhekai Duan
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/手話認識/ロボット操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルの連合ファインチューニングに関する実証研究とオープンテストベッドVLA2026/9/19
事前学習済みVLAモデルを連合学習でファインチューニングする際の設計選択を体系的に検証し、シミュレーションと実機実験を通じて知見と課題を明らかにした。
- SignVLA: 注意機構付きLSTMと視覚-言語-行動モデルによるリアルタイム手話ガイド型ロボット操作VLA/手話認識/ロボット操作2026/6/1
手話をリアルタイムで認識し、ロボット操作の指示に変換するVLAフレームワークを提案。聴覚障害者などへのアクセシビリティ向上を目指す。
- SignVLA: 手話によるロボット操作を実現するグロス不要の視覚言語行動フレームワークVLA2026/2/1
手話のグロス注釈を必要とせず、指文字のジェスチャーを直接ロボットの動作指令に変換するリアルタイムVLAシステムを提案した。
- Fast ECoT: 思考の再利用による効率的な身体性Chain-of-Thought推論VLA2025/6/1
VLAモデルの身体性Chain-of-Thought推論を、高レベル推論のキャッシュ・再利用とモジュール推論の並列生成により高速化し、学習不要でリアルタイム動作に近づけた手法。