Mirco Theile
収録論文 10本 ・ フィジカルAI/ロボット学習
強化学習/自動運転経路計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 減衰残差方策最適化による実世界自動運転レースの効率化強化学習/自動運転2026/3/1
残差方策学習を拡張し、ベース方策を徐々に減衰させて単独のニューラル方策を得る手法を提案し、1/10スケールの自動運転レースでシミュレーションと実機の両方で性能を向上させた。
- 深層強化学習による固定翼UAVの連続空間カバレッジ経路計画経路計画2025/5/1
固定翼UAVのカバレッジ経路計画を連続環境で定式化し、曲率制約付きベジェ曲線と可変サイズ矩形で環境を表現、自己適応カリキュラムを用いたAM-SACで省電力な完全カバレッジ戦略を学習した。
- 地図ベース経路計画のための強化学習における同変アンサンブルと正則化経路計画2024/3/1
強化学習において環境の対称性を活用するため、特殊なネットワーク部品を使わずに同変方策と不変価値関数を構築する同変アンサンブル法を提案し、訓練時の正則化項を加えることで、地図ベース経路計画タスクにおけるサンプル効率と性能を向上させた。
- Learning to Recharge: UAV Coverage Path Planning through Deep Reinforcement Learning2023/9/1
- Cloud-Edge Training Architecture for Sim-to-Real Deep Reinforcement Learning2022/3/1
- Multi-Agent Belief Sharing through Autonomous Hierarchical Multi-Level Clustering2021/7/1
- Multi-UAV Path Planning for Wireless Data Harvesting with Deep Reinforcement Learning2020/10/1
- UAV Path Planning using Global and Local Map Information with Deep Reinforcement Learning2020/10/1
- UAV Path Planning for Wireless Data Harvesting: A Deep Reinforcement Learning Approach2020/7/1
- UAV Coverage Path Planning under Varying Power Constraints using Deep Reinforcement Learning2020/3/1