Aniruddh G. Puranic
収録論文 5本 ・ フィジカルAI/ロボット学習
模倣学習/強化学習強化学習/安全制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 不完全なデモンストレーションからの学習:時間行動木ガイドによる軌道修復模倣学習/強化学習2026/4/1
不完全なデモンストレーションを時間行動木(TBT)仕様に基づいて修復し、修復された軌道から報酬関数を抽出して強化学習を効率的に導くフレームワークを提案した。
- リスク感応型行動価値反復と分位点回帰による安全志向強化学習制御強化学習/安全制御2025/6/1
CVaRを用いたリスク正則化分位点ベース強化学習を提案し、動的環境での移動ロボット制御において衝突を減らし目標達成率を向上させる。
- Signal Temporal Logic-Guided Apprenticeship Learning2023/11/1
- Learning Performance Graphs from Demonstrations via Task-Based Evaluations2022/4/1
- Learning from Demonstrations using Signal Temporal Logic2021/2/1