Tim Seyde
収録論文 12本 ・ フィジカルAI/ロボット学習
強化学習マルチエージェント制御動作計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ループアクター:強化学習のための深さ方向リカレント推論モデル強化学習2026/9/29
共有パラメータを繰り返し適用するループ型トランスフォーマーポリシーを提案し、状態に応じて計算量を適応的に変えることで、パラメータ数が16倍のベースラインと同等以上の性能を22タスクで達成した。
- オンボード視覚言語モデルを用いたマルチエージェントロボット制御マルチエージェント制御2026/7/1
外部計算に依存せず、搭載ハードウェア上で動作する小型VLMを専門エージェントとして複数配置し、産業倉庫内の移動マニピュレータを制御するマルチエージェントシステムを提案・検証した。
- ロボット配置空間における無衝突凸ポリトープ生成の高速化アルゴリズム動作計画2024/10/1
ロボットの配置空間で衝突のない凸領域を効率的に生成する2つの新アルゴリズムを提案し、従来手法より大幅な高速化と調整容易性を実現した。
- 成長するQネットワーク:適応的制御解像度による連続制御タスクの解決強化学習2024/4/1
離散行動空間を粗い解像度から細かい解像度へと成長させることで、連続制御タスクにおける強化学習の性能を向上させる手法を提案。
- Towards Cooperative Flight Control Using Visual-Attention2022/12/1
- Solving Continuous Control via Q-learning2022/10/1
- Interpreting Neural Policies with Disentangled Tree Representations2022/10/1
- Neighborhood Mixup Experience Replay: Local Convex Interpolation for Improved Sample Efficiency in Continuous Control Tasks2022/5/1
- Is Bang-Bang Control All You Need? Solving Continuous Control with Bernoulli Policies2021/11/1
- Deep Latent Competition: Learning to Race Using Visual Control Policies in Latent Space2021/2/1
- Learning to Plan Optimistically: Uncertainty-Guided Deep Exploration via Latent Model Ensembles2020/10/1
- Locomotion Planning through a Hybrid Bayesian Trajectory Optimization2019/3/1