Younghwan Lee
収録論文 3本 ・ フィジカルAI/ロボット学習
強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ビデオ基盤の最適輸送によるフィードバック効率的なオフライン選好ベース強化学習強化学習2026/6/1
ビデオ基盤モデルの表現空間で最適輸送を用いて軌道を整列させ、少数のラベルから高品質な擬似ラベルを生成することで、選好ベース強化学習のラベルコストを大幅に削減する半教師ありフレームワークを提案した。
- 報酬モデリング不要の大規模視覚言語モデルフィードバックによる方策学習VLA2025/7/1
大規模視覚言語モデルに軌道ペアの選好を問い合わせ、報酬モデルを学習せずに直接方策を訓練する手法PLAREを提案し、ロボット操作タスクで有効性を示した。
- 大規模視覚言語モデルのフィードバックを活用する評価ベース強化学習の強化VLA2025/6/1
大規模視覚言語モデルから軌道の絶対評価を得て報酬関数を学習するERL-VLMを提案し、データ不均衡やノイズに対処して従来手法を上回る性能を示した。