Sylvia Herbert
収録論文 25本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 制約付きフローポリシー更新:一般化シュレーディンガー橋からの視点安全強化学習2026/9/26
安全制約付き強化学習において、フローポリシーの生成経路を通じて拡張ラグランジュ目的を直接微分し、スコア推定を不要にした新しいオフポリシーアクター・クリティック法を提案。
- 時間論理のための価値関数:最適方策と安全フィルタ強化学習/時間論理2026/5/1
時間論理仕様に対する価値関数の最適性と方策の最適性の微妙な関係を解明し、非マルコフ方策を用いて病理を回避する最適方策を構築するとともに、Q関数を複雑な時間論理仕様の安全フィルタとして利用する方法を示した論文。
- オンザフライで準安全価値関数を洗練する安全制御2026/2/1
近似CBFをウォームスタート付きHJ到達可能性でオンライン修正し、局所更新で高速化するHJ-Patchを提案。実機で突発的な障害物や風外乱への適応を実証した。
- 安全な最適制御におけるタスク論理のためのベルマン価値分解安全最適制御2026/2/1
時相論理で記述された複雑なタスクのベルマン価値を、到達回避・回避・新たに提案する到達回避ループの各ベルマン方程式で結ばれたグラフに分解し、それを二層ニューラルネットに埋め込むVDPPOを提案。高次元タスクで安全性と活性を自動的に両立させ、既存手法を大きく上回る性能を示した。
- 安全確率的探索器:確率的環境における安全な目標駆動型探索と未知物体との安全な相互作用安全探索2026/2/1
ガウス過程で未知の安全関数をオンライン学習し、予測不確実性を活用して確率的環境下でも安全に目標探索と未知物体との相互作用を行うフレームワークを提案。
- 接触を許容する安全なロボット操作のためのスケーラブルなバリア関数フレームワーク安全制御2026/1/1
密集環境での接触を安全とみなす新たなバリア関数を学習し、任意の物体配置に合成可能でタスク転移も容易な安全フィルタを実現した。
- MADR: MPC誘導による敵対的DeepReach安全制御/ゲーム理論2025/10/1
MPCを活用した自己教師あり学習で2人ゼロサム微分ゲームの価値関数を高次元でも高精度に近似し、ロボットの安全な最適戦略を導出するフレームワークを提案。
- 許容制御集合を用いた到達・回避・安定化制御理論2025/5/1
複数の目標到達と障害物回避を時系列で満たしつつ最終的に安定化するための、許容制御集合に基づく到達・回避・安定化問題の解法を提案した論文。
- 割引到達可能性を用いた到達・安定化回避問題の解法制御理論2025/5/1
非線形連続時間系の到達回避・安定化回避問題に対し、割引到達可能性に基づく新しい値関数と二段階フレームワークを提案し、3D Dubins車で有効性を検証した。
- 到達可能性バリアネットワーク:滑らかで柔軟な制御バリア関数のためのハミルトン・ヤコビ解の学習制御バリア関数2025/5/1
物理情報ニューラルネットワークを用いてハミルトン・ヤコビ最適制御解を計算し、滑らかな制御バリア関数を生成する手法を提案。高次元でも安全性が向上し、保守性が低減されることを示した。
- ベースに戻れ:到達回避安全フィルタによるハンズオフ学習に向けて安全フィルタ/強化学習2025/1/1
到達回避問題の価値関数から安全フィルタを構築し、ロボットが自律的に安全なリセットを行えるようにすることで、実世界強化学習のハンズオフ訓練を効率化する手法を提案。
- 強化学習におけるハミルトン・ヤコビ到達可能性:サーベイ安全性/到達可能性2024/7/1
強化学習と組み合わせてハミルトン・ヤコビ到達可能集合を推定し、高次元システムの制御方策に安全性保証を与える最近の手法を概観したサーベイ論文。
- JIGGLE: 変形可能な手術環境における境界パラメータ推定のための能動的センシングフレームワークソフトロボティクス/手術自動化2024/5/1
軟体シミュレータと拡張カルマンフィルタを統合して組織の付着点を確率的に推定し、情報利得を最大化しつつ安全コストを最小化する能動制御で未知の境界パラメータを対話的にセンシングする枠組みを提案。
- 動的環境における安全なロボットナビゲーションのためのセンサベース分布ロバスト制御ナビゲーション2024/5/1
ノイズを含むオンボードセンサ情報を直接取り込む分布ロバスト制御バリア関数(DR-CBF)を提案し、経路追従のための制御リアプノフ関数と組み合わせることで、不確実な動的環境下でも安全かつ効率的な移動ロボットのナビゲーションを実現した。
- 方策勾配法の平滑化効果強化学習2024/5/1
方策勾配法が非平滑な最適化地形を平滑化する仕組みを後退熱方程式との等価性で解析し、確率性下での根本的課題と探索の影響を明らかにした。
- DeepReachを用いたパラメータ化高速安全追跡(FaSTrack)安全な軌道計画2024/4/1
DeepReachを活用して計画モデルの制御境界をパラメータ化し、未知環境での障害物回避を保証しつつナビゲーション速度と追従誤差をトレードオフできる新しい枠組みを提案した。
- SURESTEP: 不確実性を考慮した軌道最適化によるロバストな手術自動化のための視覚的ツール追跡の強化手術自動化2024/4/1
手術自動化におけるツール追跡の不確実性をモデル化し、エントロピー上限を最小化する軌道最適化フレームワークを提案。da Vinci Research Kitでの縫合針再把持タスクで有効性を実証。
- 安全に復帰するFaSTrack:ロバスト制御Lyapunov値関数の活用sim2real2024/4/1
ロバスト制御Lyapunov値関数とFaSTrackを組み合わせ、予期せぬ外乱からの復帰と計画モデルの人工的なジャンプによるナビゲーション高速化を両立する枠組みを提案し、10次元クアッドロータで検証した。
- Iterative Reachability Estimation for Safe Reinforcement Learning2023/9/1
- Sequential Neural Barriers for Scalable Dynamic Obstacle Avoidance2023/7/1
- Object-centric Representations for Interactive Online Learning with Non-Parametric Methods2023/7/1
- Patching Approximately Safe Value Functions Leveraging Local Hamilton-Jacobi Reachability Analysis2023/4/1
- Refining Control Barrier Functions through Hamilton-Jacobi Reachability2022/4/1
- Scalable Learning of Safety Guarantees for Autonomous Systems using Hamilton-Jacobi Reachability2021/1/1
- A Classification-based Approach for Approximate Reachability2018/3/1