Alper Kamil Bozkurt
収録論文 9本 ・ フィジカルAI/ロボット学習
強化学習/時相論理強化学習/形式仕様強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 信号時相論理のための報酬機械強化学習/時相論理2026/8/13
信号時相論理(STL)仕様を強化学習で満たすための、オートマトンに基づく効率的な記憶機構とマルコフ報酬を導入し、既存のロバスト性報酬より高い満足率とロバスト性を達成した。
- 微分可能シミュレーションを用いた線形時相論理による学習の加速強化学習/形式仕様2025/6/1
線形時相論理(LTL)と微分可能シミュレータを統合し、形式仕様から直接勾配ベースで学習できる初のエンドツーエンド枠組みを提案。接触の多い連続制御タスクで学習を大幅に加速し、離散ベースラインの最大2倍のリターンを達成した。
- LTL目的のためのベルマン方程式の解の一意性について強化学習2024/4/1
LTL目的の代理報酬で用いられる2つの割引率を持つベルマン方程式が一意解を持つ条件を明らかにし、棄却BSCC内の状態の解を0とする条件が十分であることを証明した。
- Reinforcement Learning with Temporal Logic Constraints for Partially-Observable Markov Decision Processes2021/4/1
- Model-Free Learning of Safe yet Effective Controllers2021/3/1
- Learning Optimal Strategies for Temporal Tasks in Stochastic Games2021/2/1
- Secure Planning Against Stealthy Attacks via Model-Free Reinforcement Learning2020/11/1
- Model-Free Reinforcement Learning for Stochastic Games with Linear Temporal Logic Objectives2020/10/1
- Control Synthesis from Linear Temporal Logic Specifications using Model-Free Reinforcement Learning2019/9/1