Karthik Narasimhan
収録論文 6本 ・ フィジカルAI/ロボット学習
推論学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LeAct: 専門家の行動から推論を学習する推論学習2026/7/23
専門家システムの行動から、その背後にある思考の連鎖を潜在変数として復元し、自然言語の推論として学習する手法を提案。ゲームやロボティクスで直接模倣を上回る性能を達成した。
- Leveraging Language for Accelerated Learning of Tool Manipulation2022/6/1
- Safe Reinforcement Learning with Natural Language Constraints2020/10/1
- Projection-Based Constrained Policy Optimization2020/10/1
- Evolving Graphical Planner: Contextual Global Planning for Vision-and-Language Navigation2020/7/1
- Accelerating Safe Reinforcement Learning with Constraint-mismatched Policies2020/6/1