Zachary Serlin
収録論文 11本 ・ フィジカルAI/ロボット学習
逆強化学習群制御MARLsim2real安全制御時相論理プランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SPLASH! 劣悪な階層的デモンストレーションからの長期的敵対的タスクに対するサンプル効率の良い選好ベース逆強化学習逆強化学習2025/7/1
劣悪なデモンストレーションから長期的・敵対的タスクを学習する逆強化学習手法SPLASHを提案し、シミュレーションと実世界の無人水上艇で有効性を示した。
- PRISM: 運動制約と高速情報共有による完全オンライン分散マルチエージェント経路計画群制御2025/5/1
分散型マルチエージェント経路計画アルゴリズムPRISMを提案し、運動制約情報を高速共有することでデッドロックを回避しつつ、集中型手法より多くのエージェントとタスクを扱えることを示した。
- 分散エピグラフ形式によるマルチエージェント安全最適制御MARL2025/4/1
制約付きマルコフ決定過程をエピグラフ形式で解くことで訓練を安定化させ、集中訓練・分散実行型の安全マルチエージェント強化学習手法Def-MARLを提案し、シミュレーションと実機ドローンで有効性を示した。
- 抽象から現実へ:DARPAが描く堅牢なSim-to-Real自律性のビジョンsim2real2025/3/1
DARPAのTIAMATプログラムは、低忠実度の複数シミュレーションから抽象的な共通意味を学習し、実世界環境への迅速かつ堅牢な自律技術の転移を目指す新たなsim-to-realアプローチを提案する。
- オンラインでのロバスト安全フィルタ構築:方策制御バリア関数によるアプローチ安全制御2024/10/1
価値関数をオンライン推定することでロバストな制御バリア関数を近似し、高相対次数・入力制約系でも外乱下で安全を保証するRPCBFを提案。シミュレーションとクアッドコプター実機で有効性を実証。
- Comp-LTL:ゼロショット方策合成による時相論理プランニング時相論理プランニング2024/8/1
強化学習で訓練済みのタスクプリミティブを合成し、再学習なしで任意のLTL仕様を満たすゼロショット手法を提案。環境の遷移系を構築・枝刈りして安全で適応的な計画を実現する。
- 対抗環境における協調自律性の評価:海上キャプチャー・ザ・フラッグ競技を用いて群制御2024/4/1
無人水上艇チームによるキャプチャー・ザ・フラッグ競技で、行動ベース最適化と深層強化学習の協調アルゴリズムを実環境で比較評価した。
- How to Train Your Neural Control Barrier Function: Learning Safety Filters for Complex Input-Constrained Systems2023/10/1
- Learning Minimally-Violating Continuous Control for Infeasible Linear Temporal Logic Specifications2022/10/1
- Distributed and Consistent Multi-Image Feature Matching via QuickMatch2019/10/1
- Sampling-based Motion Planning via Control Barrier Functions2019/7/1