日本フィジカルAI新聞

世界のフィジカルAIを、日本語で。

週刊ニュースレター購読
arXiv:2601.04686

Nightmare Dreamer: Dreaming About Unsafe States And Planning Ahead

Nightmare Dreamer: Dreaming About Unsafe States And Planning Ahead

シェア:XThreadsFacebookLINEはてブBluesky

著者: Oluwatosin Oseni, Shengjie Wang, Jun Zhu, Micah Corah

分類: cs.LG, cs.RO

原文アブストラクト

Reinforcement Learning (RL) has shown remarkable success in real-world applications, particularly in robotics control. However, RL adoption remains limited due to insufficient safety guarantees. We introduce Nightmare Dreamer, a model-based Safe RL algorithm that addresses safety concerns by leveraging a learned world model to predict potential safety violations and plan actions accordingly. Nightmare Dreamer achieves nearly zero safety violations while maximizing rewards. Nightmare Dreamer outperforms model-free baselines on Safety Gymnasium tasks using only image observations, achieving nearly a 20x improvement in efficiency.