Huanbin Zhou
Jilin University
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RE-0: 局所オンポリシー蒸留による身体性コード・アズ・ポリシーエージェントの検証済み再帰的改善VLA2026/9/26
教師の失敗を考慮し、学生の失敗履歴に対する教師の局所修正を環境で検証してからオンポリシー蒸留の監督に使うことで、コード生成型身体性エージェントを再帰的に改善する手法を提案。
- PACE: 長期的身体操作のためのフェーズ進行認識クレジット操作2026/8/15
長期的な操作タスクにおいて、各ステップのフェーズと進行度を推定し、ステップ単位のクレジットを割り当てることで、VLAモデルのポストトレーニングを改善するフレームワークを提案した。