Yaoxiang Pu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboFFT:順過程を用いたオンライン強化学習による生成ロボット方策のファインチューニングVLA2026/9/26
生成モデルベースの方策を、順過程ノイズ付加とスコアマッチング損失でPPO的にファインチューニングする手法を提案し、模倣学習の限界を強化学習で改善する。
- マルチモーダルエージェントによるロボット強化学習の加速強化学習2026/2/1
人間の代わりにマルチモーダルエージェントが修正ウェイポイントや空間制約を与え、ロボットの強化学習を効率化するAGPSを提案。