David Forsyth
収録論文 2本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 影響力のスナップショット:オンライン強化学習のための局所データ帰属フレームワーク強化学習2025/5/25
オンライン強化学習(PPO)において、直近の訓練バッファ内の各経験がエージェントの行動や累積報酬に与える影響を勾配類似度で測定する局所帰属フレームワークを提案し、学習診断・行動形成の時間分析・訓練中の介入に応用。さらに経験フィルタリングを反復するIIFアルゴリズムを提案し、サンプル効率と性能を向上させた。
- Sim-on-Wheels: Physical World in the Loop Simulation for Self-Driving2023/6/1