Xiaoyang Qu
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/推論高速化
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FASA: フィードバック認識型サンプリング適応による効率的な拡散ベースVLAモデルVLA2026/9/16
拡散ベースVLAモデルの推論を、視覚とグリッパ力のフィードバックを制御信号として使う学習不要のランタイム適応で高速化する手法を提案。
- VLA-InfoEntropy: 学習不要の視覚注意情報エントロピーによるVLAモデルの推論高速化と成功率向上VLA/推論高速化2026/4/1
視覚言語行動(VLA)モデルの推論を高速化するため、画像エントロピーと注意エントロピーを用いて重要領域を動的に選択し、冗長な視覚情報を削減する手法を提案した。
- VLAモデルのための汎用的な自己修正・終了フレームワークVLA2026/2/1
VLAモデルの把持時の空間的ずれと終了判定の欠如を解決するため、学習不要の軽量な自己修正制御ループVLA-SCTを提案し、LIBEROベンチマークで成功率を向上させた。
- CARE: ロボット制御のための連続潜在行動表現のマルチタスク事前学習VLA2026/1/1
行動ラベルなしで動画とテキストのペアのみから連続的な潜在行動表現を学習し、少数のラベル付きデータで微調整することでロボット制御を実現するフレームワークを提案。