Woo Kyung Kim
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- クロスドメインスキル拡散による文脈内ポリシー適応VLA2025/9/1
ドメイン非依存のプロトタイプスキルとドメイン適応スキルを拡散モデルで学習し、モデル更新なし・少量データで強化学習ポリシーを新環境に適応させるフレームワークを提案。
- 視覚言語モデルと対照的プロンプトアンサンブルによる身体性エージェントの効率的な方策適応VLA2024/12/1
事前学習済み視覚言語モデルと複数の視覚プロンプトを対照的に学習・アンサンブルし、身体性RLエージェントが未知の視覚環境変化に効率的に適応できる枠組みConPEを提案。
- LLMから実機エージェントへの身体性Chain-of-Thought蒸留VLA2024/12/1
大規模言語モデルの身体性推論能力を階層的に分解し、小型言語モデルベースの方策へ蒸留することで、容量制限のある実機デバイス上で効率的に複雑な身体性タスクを実行できるフレームワークDeDerを提案した。
- オフラインスキル拡散によるロバストな方策学習強化学習2024/3/1
限られたオフラインデータから拡散モデルで多様なスキルを生成し、異なるドメインの長期的タスクにおける方策学習を効率化するフレームワークDuSkillを提案。