Xingrui Yu
収録論文 6本 ・ フィジカルAI/ロボット学習
模倣学習/蒸留VLA/セキュリティVLA量子化VLA強化学習/生成ポリシー歩行
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 表現力豊かな教師からの敵対的二重オン方策蒸留模倣学習/蒸留2026/5/26
デモのみから学習する強化学習において、フローマッチング教師とMLP生徒を敵対的に共訓練し、報酬と行動の二つの蒸留信号でオンライン探索と局所学習を両立させる手法FA-OPDを提案。
- バックドアに基づく視覚-言語-行動モデルの所有権検証手法VLA/セキュリティ2026/5/1
視覚-言語-行動モデル(VLA)にバックドア型の透かしを埋め込み、モデル公開後の所有権を検証するフレームワークGuardVLAを提案した。
- HBVLA: 視覚-言語-行動モデルへの1ビット訓練後量子化の限界突破VLA量子化2026/2/14
VLAモデルを1ビットに二値化する際、行動生成に重要な重みをヘッセ行列で特定し、ハール領域でのグループ単位量子化を行うことで、精度劣化を抑えつつ省メモリ化を実現した。
- SA-VLA: 空間認識型フローマッチングによる視覚-言語-行動強化学習VLA2026/2/1
フローマッチング型VLAポリシーの強化学習適応時に空間的帰納バイアスが失われる問題に対し、空間表現の融合・幾何学的進捗に基づく密報酬・空間条件付き探索戦略を組み合わせ、空間分布シフト下での汎化性能を高める手法を提案。
- 事前分布マッピング共進化による拡散ポリシーの学習強化学習/生成ポリシー2025/12/2
強化学習において、最適化しやすい潜在空間で方策を訓練しつつ、条件付き生成デコーダで行動を合成するフレームワークGoRLを提案。複雑な連続制御タスクで既存手法を大幅に上回る性能を達成した。
- 外部行動好奇心による方策行動の多様化歩行2024/10/8
模倣学習に質的多様性最適化を組み合わせ、外部批評家からの好奇心報酬で多様なロボット歩行行動を獲得する手法を提案した論文。