Saurav Singh
収録論文 1本 ・ フィジカルAI/ロボット学習
人間-ロボット協調
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- オフポリシー評価による人間-ロボット協調のための強化学習の定式化人間-ロボット協調2026/2/1
実環境や人間のフィードバックなしに、記録済みの対話データのみを用いてオフポリシー評価で状態表現と報酬関数を選択する強化学習フレームワークを提案し、Lunar LanderとNASA-MATB-IIで検証した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
実環境や人間のフィードバックなしに、記録済みの対話データのみを用いてオフポリシー評価で状態表現と報酬関数を選択する強化学習フレームワークを提案し、Lunar LanderとNASA-MATB-IIで検証した。