Akhlak Uz Zaman
収録論文 1本 ・ フィジカルAI/ロボット学習
マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 文脈付き報酬機械を用いた強化学習によるタスク指向把持マニピュレーション2025/12/1
把持タスクを段階に分解し、各段階に報酬関数・行動空間・状態抽象化を与える文脈付き報酬機械を強化学習に組み込み、シミュレーションと実機で高成功率を達成した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
把持タスクを段階に分解し、各段階に報酬関数・行動空間・状態抽象化を与える文脈付き報酬機械を強化学習に組み込み、シミュレーションと実機で高成功率を達成した。