Xinyu Tan
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/手話認識/ロボット操作VLA/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚言語行動モデルの連合ファインチューニングに関する実証研究とオープンテストベッドVLA2026/9/19
事前学習済みVLAモデルを連合学習でファインチューニングする際の設計選択を体系的に検証し、シミュレーションと実機実験を通じて知見と課題を明らかにした。
- SignVLA: 注意機構付きLSTMと視覚-言語-行動モデルによるリアルタイム手話ガイド型ロボット操作VLA/手話認識/ロボット操作2026/6/1
手話をリアルタイムで認識し、ロボット操作の指示に変換するVLAフレームワークを提案。聴覚障害者などへのアクセシビリティ向上を目指す。
- 弾性クエリ強化学習:VLAモデルの自己認識型ポリシー実行VLA/強化学習2026/6/1
VLAモデルの推論・再計画スケジュールを固定せず、状態の難易度に応じてクエリの入力・ノイズ除去予算・アクション長を動的に調整する枠組みEQRLを提案。軽量な適応器と批評家の不一致による難易度信号で計算資源を効率的に配分し、シミュレーションと実機で推論コストを削減しつつ成功率を維持・向上させた。
- SignVLA: 手話によるロボット操作を実現するグロス不要の視覚言語行動フレームワークVLA2026/2/1
手話のグロス注釈を必要とせず、指文字のジェスチャーを直接ロボットの動作指令に変換するリアルタイムVLAシステムを提案した。