Maxim Mednikov
収録論文 2本 ・ フィジカルAI/ロボット学習
群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 一度のキャリブレーションでどんなチームでも飛行可能:残差補正に基づく低忠実度訓練による協調ドローン群制御群制御2026/9/15
高忠実度シミュレータでの強化学習を不要にし、低忠実度シミュレータを1機のキャリブレーション飛行で補正して、チーム規模に依存しない協調ドローン群ポリシーを訓練する手法を提案。
- 遅延補償の分離:学習されたダイナミクスフィルタリングによる事前学習済みMARLポリシーの強化群制御2026/5/1
実世界のマルチエージェント強化学習では通信遅延やパケット損失が性能を劣化させるため、遅延した観測を現在の信念状態推定に置き換えるモジュール型の実行段階状態推定層を提案した。この層は事前学習済みポリシーにプラグインとして追加でき、元の学習アルゴリズムや報酬構造を変更せずに通信遅延やメッセージ損失に対するロバスト性を向上させる。