Yifan Su
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習/操作群制御強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlowDPG: フローマッチングポリシーに対する決定論的ポリシー勾配の実世界操作への応用強化学習/操作2026/6/1
フローマッチングポリシーにDDPGスタイルの強化学習を適用する際、時間方向の逆伝播(BPTT)を回避する蒸留フレームワークを提案し、実世界の長期的な両腕組み立てタスクで92%の成功率を達成した。
- BTPG-max:双方向時間計画グラフにおける局所最大双方向ペアの達成群制御2025/8/1
遅延に強いマルチエージェント経路計画のため、双方向ペアを局所最大まで増やすアルゴリズムBTPG-maxを提案し、遅延への頑健性を向上させた。
- 進化的方策最適化強化学習2025/3/1
進化的アルゴリズムのスケーラビリティと方策勾配の安定性を組み合わせたハイブリッド強化学習手法EPOを提案し、巧みな操作や歩行タスクで性能を向上させた。
- Bidirectional Temporal Plan Graph: Enabling Switchable Passing Orders for More Efficient Multi-Agent Path Finding Plan Execution2024/1/1