Jaehong Yoon
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA映像理解画像生成ビデオ理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Attacca: 状態連続性下での長期身体エージェントのための目標指向制御VLA2026/10/6
長期タスク実行中の状態連続性に対応するため、検索から相互作用までの軌跡で視覚目標条件付きポリシーを訓練するAttaccaを提案。目標画像を実行環境から切り離し、行動フェーズ条件付けを導入。
- 信頼度を考慮したツール連携による堅牢な映像理解映像理解2026/6/25
映像推論モデルが入力フレームの劣化(ぼけや遮蔽など)を盲信する問題を指摘し、フレームごとの信頼度を推論に組み込むエージェント型フレームワークRobust-TOを提案した。
- 速度編集による安全な少数ステップ生成画像生成2026/6/22
フローマッチングを用いたテキスト画像生成において、安全条件付き後方分布に基づいて速度場を直接編集し、プロンプトを変えずに安全な出力へ軌道を誘導するトレーニング不要の手法VESFlowを提案した。
- EgoMemReason: 長時間の自己中心視点映像理解のための記憶駆動型推論ベンチマークビデオ理解2026/5/11
数日間にわたる自己中心視点映像の理解を評価する新しいベンチマークを提案し、エンティティ記憶、イベント記憶、行動記憶の3種類の記憶に基づく推論をテストする。