Bikang Pan
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SelfWAM: 自己接地型統一ワールドアクションモデルによる高速ロボット制御VLA2026/8/1
ロボットの行動と将来の観測を同時に予測する統一モデルを提案し、行動条件付きの将来予測を自己マスクで接地することで、ポリシー学習の性能を向上させた。
- 批判者ガイダンスによるサンプル効率的な拡散ベース強化学習強化学習2026/5/1
拡散ポリシーを用いた強化学習において、探索と活用のバランスを改善するため、訓練不要のガイダンス技術を拡散過程に統合し、批判者ネットワークが高価値と判断する領域へ行動生成を誘導する手法CGPOを提案した。MuJoCoの5つのタスクで最先端の性能を達成した。