Nicanor Quijano
収録論文 1本 ・ フィジカルAI/ロボット学習
強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 世界モデルが強化学習エージェントの最適採餌戦略を実現する強化学習2025/12/14
学習した世界モデルを持つ人工採餌エージェントが、限界価値定理に沿ったパッチ離脱行動を自然に獲得することを示し、予測的世界モデルが生物学的に妥当な意思決定の基盤となる可能性を提示した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
学習した世界モデルを持つ人工採餌エージェントが、限界価値定理に沿ったパッチ離脱行動を自然に獲得することを示し、予測的世界モデルが生物学的に妥当な意思決定の基盤となる可能性を提示した。