Tewodros Ayalew
収録論文 2本 ・ フィジカルAI/ロボット学習
世界モデル報酬学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CLAW: 敵対的潜在正則化による連続潜在アクション世界モデルの学習世界モデル2026/6/1
アクションラベルなしのビデオから、連続的な潜在アクション表現と世界モデルを同時に学習する自己教師ありフレームワークを提案。模倣学習と目標指向プランニングに応用できる。
- PROGRESSOR: 自己教師ありオンライン精緻化を伴う知覚誘導型報酬推定器報酬学習2024/11/1
大規模な一人称視点動画からタスク非依存の報酬関数を自己教師ありで学習し、オンラインRL中に敵対的に精緻化することで、人手による報酬設計なしにロボットの複雑な行動獲得を可能にするフレームワーク。