Manith Adikari
収録論文 3本 ・ フィジカルAI/ロボット学習
多目的強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LEMUR: 嗜好フィードバックを用いた多目的強化学習によるアライメント学習多目的強化学習2026/7/1
複数の競合する目的を持つタスクにおいて、複数の人間の嗜好フィードバックから報酬モデルと方策を同時に学習する新しいフレームワークを提案し、ベンチマークタスクで優れた性能を示した。
- 階層型視覚言語行動モデルの明示的な言語-行動整合による接地VLA2026/4/1
ロボットの言語と行動の整合性を明示的に学習するフレームワークを提案し、階層型VLAモデルの接地を改善した。
- Social Robot Mediator for Multiparty Interaction2023/10/1