Yinan Wu
Tsinghua University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/パラメータ効率的ファインチューニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Vision-Language-Actionモデル向け分位点ヘッドVLA2026/9/28
VLAモデルの行動ヘッドとして、回帰とフローマッチングを統一的に扱う分位点目的を導入し、1回の順伝播で分位点を予測するQuantile Headを提案。LIBERO系ベンチマークと実機タスクで成功率と効率を改善した。
- PhaseLoRA: 制御フェーズ条件付き低ランク適応による連続動作VLAポリシーVLA/パラメータ効率的ファインチューニング2026/8/15
連続動作の操作タスクにおいて、制御フェーズ(接近、接触、把持など)に応じて適応を変化させる軽量なLoRAパラメータ化を提案し、LIBEROベンチマークで成功率を大幅に向上させた。
- CofactVLA: 反事実的介入による視覚・言語・行動モデルの交絡除去VLA2026/8/5
視覚・言語・行動モデルが言語指示を無視して視覚的な交絡因子に過適合する問題を、反事実的介入を用いて軽減する新しい因果介入フレームワークを提案した。