Xuehui Yu
National University of Singapore
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA生成モデルメタ強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 分割して記憶する:長期的VLAポリシーのための再帰的行動関連メモリVLA2026/10/1
現在の観測だけでは行動を決められない履歴依存の操作タスクに向け、行動に関連する情報を履歴から再帰的に選択・記憶する軽量メモリ手法を提案し、長期的操作ベンチマークで最高精度を達成した。
- 構成報酬下でのフローモデルに対する競合認識型加法的ガイダンス生成モデル2026/5/1
複数の制約を同時に課す際に生じるオフマニフォールドドリフトを、勾配の競合を動的に検出・解決することで補正する軽量な学習可能なガイダンス手法を提案した。
- スキル認識型相互情報量最適化による強化学習の汎化メタ強化学習2024/6/1
メタ強化学習において、スキルを区別する相互情報量目的関数SaMIとその推定器SaNCEを提案し、未見タスクへのゼロショット汎化とサンプル効率を改善した。