Yufeng Ji
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HiRE: 後知恵報酬編集による方策ファインチューニング強化学習2026/9/22
成功・失敗軌跡を後知恵で対比し、基盤表現モデルの報酬を制御中心に校正する訓練不要の枠組みを提案。
- Action QFormer: 行動監視下での構造化表現形成による視覚言語行動モデルの性能向上VLA2026/7/1
視覚言語行動モデルにおいて、行動監視が継承したマルチモーダル表現を形成する役割を分析し、クエリベースのインターフェースを導入して行動に適した表現を再構成することで、ゼロショットsim-to-realナビゲーションの成功率を大幅に向上させた。