Dongyoon Han
NAVER AI Lab
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/検索拡張ロボット制御/視覚表現/拡散モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロバストな視覚言語エンコーダのための等方性埋め込み摂動VLA2026/9/9
埋め込み空間に拡散的なランダム摂動を加えるAetherを提案し、視覚言語モデルのマルチモーダル整合性を損なわずに正則化性能を向上させた。
- 再学習せずに検索せよ:テスト時に視覚言語行動モデルを新タスクへ拡張する手法VLA/検索拡張2026/6/14
新しいタスクへの適応を、モデルの再学習ではなく、デモンストレーションの検索で置き換える手法を提案。凍結したポリシーが検索した軌跡を条件付けに使い、タスク追加をパラメータ更新なしで実現する。
- 拡散モデルをロボット制御に活用するための条件の探求ロボット制御/視覚表現/拡散モデル2025/10/1
事前学習済みテキスト画像拡散モデルを微調整せずにロボット制御のためのタスク適応的な視覚表現として利用する手法ORCAを提案し、制御タスクに適した条件設計の重要性を示した。