Lauren Robson
収録論文 1本 ・ フィジカルAI/ロボット学習
報酬設計
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 反復報酬設計の俯瞰的ベンチマーク報酬設計2026/10/3
LLMによる報酬関数の反復改善手法を統一環境で比較するベンチマークBIRDを提案し、単純な設計選択の組み合わせが既存手法より高性能であることを示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
LLMによる報酬関数の反復改善手法を統一環境で比較するベンチマークBIRDを提案し、単純な設計選択の組み合わせが既存手法より高性能であることを示した。