日本フィジカルAI新聞

世界のフィジカルAIを、日本語で。

週刊ニュースレター購読
arXiv:2502.21057

Robust Deterministic Policy Gradient for Disturbance Attenuation and Its Application to Quadrotor Control

Robust Deterministic Policy Gradient for Disturbance Attenuation and Its Application to Quadrotor Control

シェア:XThreadsFacebookLINEはてブBluesky

著者: Taeho Lee, Donghwan Lee

分類: cs.RO, cs.AI

原文アブストラクト

This paper presents a robust reinforcement learning algorithm called robust deterministic policy gradient (RDPG), which reformulates the H-infinity control problem as a two-player zero-sum dynamic game between a user and an adversary. The method combines deterministic policy gradients with deep reinforcement learning to train a robust policy that attenuates disturbances efficiently. A practical variant, robust deep deterministic policy gradient (RDDPG), integrates twin-delayed updates for stability and sample efficiency. Experiments on an unmanned aerial vehicle demonstrate superior robustness and tracking accuracy under severe disturbance conditions.