Jonathon M. Smereka
収録論文 12本 ・ フィジカルAI/ロボット学習
マルチエージェント強化学習強化学習状態推定移動ロボット/状態推定sim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MA-VLCM: マルチエージェントチーム設定における方針価値推定のための視覚言語批評モデルマルチエージェント強化学習2026/3/1
マルチエージェント強化学習において、学習済み視覚言語モデルを微調整して中央批評家として用いることで、方針学習中の批評家学習を不要にし、サンプル効率と汎化性を向上させるフレームワークを提案した。
- 分布方策勾配のための一般化アドバンテージ推定強化学習2025/7/1
最適輸送理論に基づくワッサースタイン型方向性指標を用いて、分布強化学習向けの一般化アドバンテージ推定(DGAE)を提案し、複数の方策勾配法に統合して性能を評価した論文。
- スキッドステア車両の状態推定のための運動モードのガウス混合モデルによる特性評価状態推定2025/5/1
スキッドステア移動ロボットの角速度推定において、運動モードをガウス混合モデルでクラスタリングし、IMMベースの状態推定に組み込む手法を提案した。
- 相互作用多重モデル推定による横滑りモードのオンライン同定移動ロボット/状態推定2024/9/1
スキッドステア型車輪移動ロボットの走行中に生じる車輪と地面の相互作用による動作モードを、相互作用多重モデル(IMM)フィルタで確率的にオンライン同定するフレームワークを提案した。
- 未知の変形地形におけるオフロード走行のための強化学習補償モデル予測制御sim2real2024/8/1
未知のタイヤ・地形間の相互作用に対処するため、深層強化学習でモデル予測制御を補償し、変形地形での高速オフロード自律走行を実現するフレームワークを提案した。
- Task Allocation with Load Management in Multi-Agent Teams2022/7/1
- Bayesian Optimization Based Trustworthiness Model for Multi-robot Bounding Overwatch2022/1/1
- Trust-based Symbolic Motion Planning for Multi-robot Bounding Overwatch2022/1/1
- Two-stage stochastic programming approach for path planning problems under travel time and availability uncertainties2019/10/1
- Security and Performance Considerations in ROS 2: A Balancing Act2018/9/1
- Open Problems in Robotic Anomaly Detection2018/9/1
- Tree Search Techniques for Minimizing Detectability and Maximizing Visibility2018/7/1