Christopher Amato
収録論文 21本 ・ フィジカルAI/ロボット学習
セキュリティ/ワールドモデルナビゲーション強化学習セキュリティマルチエージェント強化学習強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット学習パイプラインを侵害するためのワールドモデル攻撃セキュリティ/ワールドモデル2026/6/1
ワールドモデルを介して、一見安全な遠隔操作データに悪意のあるプロンプトや遷移ダイナミクスを埋め込み、危険な合成訓練データを生成してロボットポリシーを侵害する新たなデータポイズニング攻撃手法を提案した。
- マルチエージェント強化学習によるクロスモーダルナビゲーションナビゲーション2026/5/1
視覚と音響などの異なるモダリティを持つ軽量エージェント群が協調してナビゲーションを行うMARLフレームワークCRONAを提案し、単一エージェントより性能と効率が向上することを示した。
- 信頼できないシミュレータに注意:強化学習における報酬なしバックドア攻撃強化学習セキュリティ2026/2/1
シミュレータのダイナミクスを改ざんして、報酬を操作せずに強化学習エージェントに行動レベルのバックドアを仕込み、特定のトリガーで危険な行動を引き起こす攻撃手法「Daze」を提案し、実機ロボットへの転移も示した。
- エントロピー探索による安全なマルチエージェント協調マルチエージェント強化学習2024/12/1
チーム制約下でのマルチエージェント強化学習において、観測エントロピー最大化で探索を促し、安全性を保ちつつ協調行動を学習する手法E2Cを提案。
- 部分観測下における同変強化学習強化学習2024/8/1
部分観測環境で群対称性の同変性をニューラルネットに組み込み、過去の解を再利用することでサンプル効率と性能を高める強化学習手法を提案した。
- Vision and Language Navigation in the Real World via Online Visual Language Mapping2023/10/1
- On-Robot Bayesian Reinforcement Learning for POMDPs2023/7/1
- Leveraging Fully Observable Policies for Learning under Partial Observability2022/11/1
- Asynchronous Actor-Critic for Multi-Agent Reinforcement Learning2022/9/1
- Hierarchical Reinforcement Learning under Mixed Observability2022/4/1
- Hierarchical Robot Navigation in Novel Environments using Rough 2-D Maps2021/6/1
- End-to-end grasping policies for human-in-the-loop robots via deep reinforcement learning2021/4/1
- Decentralized Reinforcement Learning for Multi-Target Search and Detection by a Team of Drones2021/3/1
- Belief-Grounded Networks for Accelerated Robot Learning under Partial Observability2020/10/1
- Macro-Action-Based Deep Multi-Agent Reinforcement Learning2020/4/1
- Learning Multi-Robot Decentralized Macro-Action-Based Policies via a Centralized Q-Net2019/9/1
- Learning for Multi-robot Cooperation in Partially Observable Stochastic Environments with Macro-actions2017/7/1
- Scalable Accelerated Decentralized Multi-Robot Policy Search in Continuous Observation Spaces2017/3/1
- Semantic-level Decentralized Multi-Robot Decision-Making using Probabilistic Macro-Observations2017/3/1
- Decentralized Control of Partially Observable Markov Decision Processes using Belief Space Macro-actions2015/2/1
- Planning for Decentralized Control of Multiple Robots Under Uncertainty2014/2/1