Zhanyi Sun
収録論文 7本 ・ フィジカルAI/ロボット学習
連続学習マニピュレーション強化学習/操作VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 連続ロボット学習のためのメモリアンカー連続学習2026/8/27
ロボットが新しいタスクを学習しても過去のタスクを忘れないようにするため、リプレイバッファ内の重要経験(メモリアンカー)を特定し、それを活用することで破滅的忘却を大幅に軽減する手法を提案した。
- ロボット操作の堅牢性:基礎と最前線マニピュレーション2026/6/1
ロボット操作における堅牢性の定義を明確化し、確率論的・制御理論的観点から定式化、各モジュールでの実現機構を整理し、評価方法と将来課題を論じたサーベイ論文。
- 事前学習から熟達へ:分布収縮型強化学習による効率的なスキル習得強化学習/操作2026/3/1
事前学習済みの生成ロボットポリシーを、分布収縮型強化学習(DICE-RL)で微調整し、高成功率の行動を増幅して高性能な「プロ」ポリシーへと進化させる手法を提案。シミュレーションと実機で高次元ピクセル入力からの複雑な長期的操作スキルの習得を実証した。
- 潜在ポリシーバリア:分布内に留まることで堅牢な視覚運動ポリシーを学習するVLA2025/8/1
専門家デモの潜在表現を障壁として扱い、拡散ポリシーとダイナミクスモデルを組み合わせて、追加の人間修正なしに視覚運動ポリシーの堅牢性とデータ効率を向上させるフレームワークを提案。
- RL-VLM-F: 視覚言語基盤モデルのフィードバックによる強化学習VLA2024/2/1
タスクのテキスト説明とエージェントの視覚観測のみから、視覚言語基盤モデルに画像ペアの選好を問い合わせて報酬関数を自動生成し、人間の監督なしに様々なタスクを学習する手法を提案。
- Force-Constrained Visual Policy: Safe Robot-Assisted Dressing via Multi-Modal Sensing2023/11/1
- One Policy to Dress Them All: Learning to Dress People with Diverse Poses and Garments2023/6/1