William Sharpless
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習/時間論理安全最適制御安全制御/ゲーム理論制御バリア関数
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 時間論理のための価値関数:最適方策と安全フィルタ強化学習/時間論理2026/5/1
時間論理仕様に対する価値関数の最適性と方策の最適性の微妙な関係を解明し、非マルコフ方策を用いて病理を回避する最適方策を構築するとともに、Q関数を複雑な時間論理仕様の安全フィルタとして利用する方法を示した論文。
- 安全な最適制御におけるタスク論理のためのベルマン価値分解安全最適制御2026/2/1
時相論理で記述された複雑なタスクのベルマン価値を、到達回避・回避・新たに提案する到達回避ループの各ベルマン方程式で結ばれたグラフに分解し、それを二層ニューラルネットに埋め込むVDPPOを提案。高次元タスクで安全性と活性を自動的に両立させ、既存手法を大きく上回る性能を示した。
- MADR: MPC誘導による敵対的DeepReach安全制御/ゲーム理論2025/10/1
MPCを活用した自己教師あり学習で2人ゼロサム微分ゲームの価値関数を高次元でも高精度に近似し、ロボットの安全な最適戦略を導出するフレームワークを提案。
- 到達可能性バリアネットワーク:滑らかで柔軟な制御バリア関数のためのハミルトン・ヤコビ解の学習制御バリア関数2025/5/1
物理情報ニューラルネットワークを用いてハミルトン・ヤコビ最適制御解を計算し、滑らかな制御バリア関数を生成する手法を提案。高次元でも安全性が向上し、保守性が低減されることを示した。