Yanping Zhao
Tongji University
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GWM-VLA:視覚言語行動学習のための幾何認識潜在世界モデリングVLA2026/8/1
視覚言語行動モデルの堅牢性を向上させるため、幾何情報を考慮した多視点状態符号化と潜在世界モデルを導入し、手首視点の予測と共有潜在行動表現によりロボット操作性能を高めた。
- 適応チャンクサイズのアクタークリティックと因果トランスフォーマーQネットワーク強化学習2026/5/1
強化学習における長期的・疎報酬タスク向けに、チャンクサイズを状態に応じて適応的に選択するアクタークリティック法を提案し、オフラインおよびオフラインからオンラインへの設定で最先端性能を達成した。