William Schafer
収録論文 2本 ・ フィジカルAI/ロボット学習
プランニング強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボットはいつ再計画すべきか?時間変動MDPにおける後悔に基づく更新スケジューリングプランニング2026/6/15
非定常環境で動作するロボットが、限られた計算予算の中でいつ再計画すべきかを、後悔(リグレット)理論に基づいて決定する手法を提案した論文。
- 断続的観測下における欺瞞的政策のオンライン学習強化学習2025/9/1
監視が時々しか行われない状況で、観測時に監督者の期待に沿うように振る舞いつつ私的目的を達成する欺瞞的行動を、心の理論を活用したオンライン強化学習で獲得する手法を提案し、船舶・ドローンの実験で有効性を示した。