Jaehyuk Kim
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- スカラー随伴マッチングによるQ学習強化学習2026/10/7
フローポリシーのファインチューニングにおいて、各ステップのヤコビアン計算を不要にするスカラー随伴を提案し、OGBenchの難タスクで成功率を大幅に改善した。
- 信頼領域Q-随伴マッチング強化学習2026/5/1
事前学習済みフローポリシーのオフポリシー強化学習を安定化するため、経路空間KLを信頼領域パラメータで制御するTRQAMを提案し、50のOGBenchタスクで既存手法を上回る性能を達成した。