Sangdoo Yun
NAVER AI Lab
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/検索拡張
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロバストな視覚言語エンコーダのための等方性埋め込み摂動VLA2026/9/9
埋め込み空間に拡散的なランダム摂動を加えるAetherを提案し、視覚言語モデルのマルチモーダル整合性を損なわずに正則化性能を向上させた。
- 再学習せずに検索せよ:テスト時に視覚言語行動モデルを新タスクへ拡張する手法VLA/検索拡張2026/6/14
新しいタスクへの適応を、モデルの再学習ではなく、デモンストレーションの検索で置き換える手法を提案。凍結したポリシーが検索した軌跡を条件付けに使い、タスク追加をパラメータ更新なしで実現する。
- 成功・失敗デモンストレーションを活用した階層型視覚言語行動モデルVLA2025/12/1
失敗デモも学習信号として活用し、高レベル推論と低レベル制御を分離した階層型VLAモデルVINEを提案。計画時に失敗を考慮した探索を行うことでマニピュレーションの成功率とロバスト性を向上させた。