Donggeon David Oh
収録論文 6本 ・ フィジカルAI/ロボット学習
安全強化学習安全制御/制御バリア関数安全制御/強化学習共有自律/安全フィルタ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 安全性を競技力へ:安全フィルタ付き強化学習による搾取されにくいロボット方策安全強化学習2026/9/23
競技タスク向けに、安全フィルタを敵対的RLで学習してからタスク方策を訓練する2段階フレームワークS2Cを提案し、安全性と競技性能・非搾取性を両立させた。
- 勝利済みゲームに勝つ:高次元ブラックボックス系に対する厳密な到達・回避・滞在制御バリア関数安全制御/制御バリア関数2026/9/16
高次元ブラックボックス系に対し、目標へ安全に到達し到達後は永続的に安全を保つ厳密な到達・回避・滞在(sRAS)を保証するQ制御バリア関数ベースの安全フィルタを提案し、四足ロボットのギャップ跳躍などで検証した。
- 敵対的強化学習による最大ロバスト制御バリア関数の合成と展開安全制御/強化学習2026/4/1
一般の非線形システムに対して、動的計画法とQ関数を用いた新しいロバスト制御バリア関数を提案し、敵対的強化学習で合成・展開する手法を導入した。
- 安全フィルタリング下での証明可能に最適な強化学習安全強化学習2025/10/1
安全フィルタを環境の一部として組み込んだフィルタ済みMDPを定式化し、十分に許容的なフィルタを用いれば漸近性能を損なわずに安全性を保証できることを証明した。
- 主体性を保つ安全フィルタ:人間中心の安全制約をAI支援モータースポーツに適用共有自律/安全フィルタ2025/4/1
人間の操作を最小限に滑らかに修正するニューラル安全価値関数ベースの安全フィルタを提案し、ブラックボックスなレースシミュレータでのユーザー研究で安全性と満足度の向上を示した。
- Stable Contact Guaranteeing Motion/Force Control for an Aerial Manipulator on an Arbitrarily Tilted Surface2023/1/1