Hikmet Simsir
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習/生成的ポリシー
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ラグランジアン摂動拡散ステアリング:生成的ポリシーのための潜在強化学習強化学習/生成的ポリシー2026/5/31
凍結した生成的ポリシーに対し、ノイズ空間の小さな摂動を学習して性能を改善する軽量適応手法LP-DSを提案。ロボット操作や移動、器用操作のベンチマークで成功率と報酬を向上させた。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
凍結した生成的ポリシーに対し、ノイズ空間の小さな摂動を学習して性能を改善する軽量適応手法LP-DSを提案。ロボット操作や移動、器用操作のベンチマークで成功率と報酬を向上させた。