Jean-Baptiste Bouvier
収録論文 5本 ・ フィジカルAI/ロボット学習
安全強化学習マルチエージェント強化学習拡散ポリシー軌道制御強化学習/安全制約
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ブラックボックスハイブリッド力学系におけるハードアフィン制約を証明付きで満たす制御ポリシーの学習安全強化学習2026/4/1
未知の非線形ダイナミクスを持つハイブリッドシステムに対し、制約境界付近でアフィンかつ反発的なポリシーを強制することで、閉ループで安全制約を証明付きで満たす強化学習ポリシーを学習する手法を提案した。
- 大規模言語モデルを活用した効果的で説明可能なマルチエージェント信用割当マルチエージェント強化学習2025/2/1
マルチエージェント強化学習の信用割当問題を、LLMによる報酬分解とタスク割当として再定式化し、各エージェントの貢献を評価する手法を提案した。
- DDAT: 動的に実行可能なロボット軌道を強制する拡散ポリシー拡散ポリシー2025/2/1
拡散モデルを用いてロボットの運動方程式に厳密に従う実行可能な軌道を生成するため、学習と推論の両方で予測を動的実行可能多様体に射影する手法を提案。
- 分布ロバストチャンス制約によるリスク感応型軌道デブリ衝突回避軌道制御2024/12/1
非ガウス的なデブリ位置分布の平均と共分散のみを用い、分布ロバストなチャンス制約で衝突確率を抑えつつ燃料消費を最小化する軌道回避アルゴリズムを提案した。
- POLICEd RL:ハード制約の充足を保証する閉ループロボット制御方策の学習強化学習/安全制約2024/3/1
アフィンなハード制約を強制する新しい強化学習アルゴリズムを提案し、学習方策を不安全集合周辺でアフィンにすることで制約違反を防ぐ反発バッファを形成し、制約充足を証明した。