Ram Padmanabhan
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 断続的観測下における欺瞞的政策のオンライン学習強化学習2025/9/1
監視が時々しか行われない状況で、観測時に監督者の期待に沿うように振る舞いつつ私的目的を達成する欺瞞的行動を、心の理論を活用したオンライン強化学習で獲得する手法を提案し、船舶・ドローンの実験で有効性を示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
監視が時々しか行われない状況で、観測時に監督者の期待に沿うように振る舞いつつ私的目的を達成する欺瞞的行動を、心の理論を活用したオンライン強化学習で獲得する手法を提案し、船舶・ドローンの実験で有効性を示した。