Haoyang Du
収録論文 2本 ・ フィジカルAI/ロボット学習
マニピュレーションヒューマン・イン・ザ・ループ強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AffordTrajDP: 動的アフォーダンス誘導によるロボット操作の視覚運動ポリシー学習マニピュレーション2026/8/1
静的アフォーダンスの限界を克服するため、物体のSE(3)姿勢を媒体にアフォーダンス軌道を生成し、時間的に一貫した状態認識ガイダンスを提供する動的フレームワークを提案。ManiSkill3で70%の成功率を達成し、実機でも堅牢性を実証した。
- E2HiL: エントロピー誘導サンプル選択による効率的な実世界ヒューマン・イン・ザ・ループ強化学習ヒューマン・イン・ザ・ループ強化学習2026/1/1
方策エントロピーへの影響度を推定し、有益なサンプルを能動的に選ぶことで、人手介入を減らしつつ実世界マニピュレーションタスクの学習を効率化するヒューマン・イン・ザ・ループ強化学習フレームワークを提案した。