Diyuan Shi
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PreferenceFlow: 人間介入によるフローマッチングロボット方策のテスト時ガイダンスVLA2026/9/29
人間の介入とロボットの行動を比較して選好モデルを学習し、報酬なしで事前学習済みフローマッチング方策をテスト時に誘導する手法を提案。実機の精密挿入タスクで成功率を69%から90.5%に向上させた。
- NFPO: 正規化フローによるロボットポリシー学習の安定化ポリシー最適化強化学習2026/3/1
ロボットの強化学習で、多峰性分布を表現できる正規化フローをポリシーとして用いる際の訓練不安定性を分析し、簡単な手法で安定化させて性能を向上させた。
- 深層強化学習によるヒューマノイドロボットの自己保護転倒ポリシーの発見強化学習2025/12/1
深層強化学習とカリキュラム学習を用いて、ヒューマノイドロボットが転倒時に自己保護するためのポリシーを学習させ、三角形の姿勢を形成することで損傷を大幅に低減できることを発見し、実機に転移した。
- TDMPBC:自己模倣強化学習によるヒューマノイドロボット制御強化学習2025/2/1
強化学習において、タスクに関連する可能性のある軌道を自己模倣することで、ヒューマノイドロボットの制御性能を大幅に向上させるフレームワークSIRLを提案した。
- Unlock Reliable Skill Inference for Quadruped Adaptive Behavior by Skill Graph2023/11/1