Kartik Nagpal
収録論文 6本 ・ フィジカルAI/ロボット学習
安全制御安全強化学習マルチエージェント強化学習拡散ポリシー強化学習/安全制約
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 任意ボディガード:アクションマスキングによる操作ポリシーの普遍的安全保護安全制御2026/6/1
ロボット操作ポリシーの安全性を、構成空間で直接推論し、衝突回避の形式的確率的保証を提供する普遍的な安全保護手法X-Safeを提案。多様なロボット形態やタスクに追加データやエンジニアリングなしで適用可能。
- ブラックボックスハイブリッド力学系におけるハードアフィン制約を証明付きで満たす制御ポリシーの学習安全強化学習2026/4/1
未知の非線形ダイナミクスを持つハイブリッドシステムに対し、制約境界付近でアフィンかつ反発的なポリシーを強制することで、閉ループで安全制約を証明付きで満たす強化学習ポリシーを学習する手法を提案した。
- 大規模言語モデルを活用した効果的で説明可能なマルチエージェント信用割当マルチエージェント強化学習2025/2/1
マルチエージェント強化学習の信用割当問題を、LLMによる報酬分解とタスク割当として再定式化し、各エージェントの貢献を評価する手法を提案した。
- DDAT: 動的に実行可能なロボット軌道を強制する拡散ポリシー拡散ポリシー2025/2/1
拡散モデルを用いてロボットの運動方程式に厳密に従う実行可能な軌道を生成するため、学習と推論の両方で予測を動的実行可能多様体に射影する手法を提案。
- POLICEd RL:ハード制約の充足を保証する閉ループロボット制御方策の学習強化学習/安全制約2024/3/1
アフィンなハード制約を強制する新しい強化学習アルゴリズムを提案し、学習方策を不安全集合周辺でアフィンにすることで制約違反を防ぐ反発バッファを形成し、制約充足を証明した。
- Optimal Robotic Assembly Sequence Planning: A Sequential Decision-Making Approach2023/10/1