Youngjae Yu
Seoul National University
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ヒューマノイドツールベンチ:ツール選択から移動を伴う実行までを評価ヒューマノイド/ツール使用2026/10/1
ヒューマノイドが道具を選び、操作と移動を組み合わせてタスクを遂行する能力を評価する18タスクのベンチマークと3.1kデモのデータセットを提案し、実機・シミュレーションで既存手法の課題を明らかにした。
- 同じ軌道、矛盾する報酬(ROBORMBENCH):視覚言語報酬モデルにおける言い換えの脆弱性VLM報酬モデル2026/9/4
視覚言語モデルをロボット学習の報酬関数として使う際、意味的に等価な指示の言い換えで報酬が大きく変わり、成功と失敗が反転することもあることを示し、その脆弱性を測るベンチマークROBORMBENCHを構築した。
- PonderPounce: 事前学習済みMLLMをロボット制御のエピソードコンテキストエンジンとして活用VLA2026/8/25
PonderPounceは、マルチモーダル大規模言語モデル(MLLM)のネイティブな因果コンテキストをロボットの記憶として再利用し、エピソード観察やデモンストレーションを蓄積してサブゴール生成を行うSystem2と、現在の観察から直接アクションを出力するSystem1のVLAを非同期に連携させる新しいアーキテクチャを提案する。専用の記憶モジュールやブリッジ事前学習なしでエンドツーエンドに訓練され、低遅延で高周波のアクション生成を実現する。
- SafeBranch: 身体化エージェントのための分岐ペア安全性アライメントVLA/安全性2026/8/20
身体化エージェントの安全性を高めるため、安全違反を起こした軌道を巻き戻して安全な代替行動とペアにし、その分岐ペアで学習するフレームワークを提案。タスク成功率を保ちつつ安全性を大幅に向上させた。
- JointHOI: 接触マップの同時生成による手と物体のインタラクション生成の強化拡散モデル/手と物体のインタラクション2026/7/2
テキストから手と物体のインタラクションを生成する際、接触マップを同時生成する単一ステージの拡散モデルを提案し、物理的整合性を向上させた。
- 自己回帰ポリシーによるリアルタイム実行VLA2026/6/1
自己回帰型の視覚言語行動モデルをリアルタイムで実行する手法を提案し、トークン化の調整と制約付きデコードにより遅延を保証して性能を向上させることを示した。
- CostNav: 物理AIエージェントの実世界経済コスト評価のためのナビゲーションベンチマークナビゲーション2025/11/1
配送ロボットのナビゲーションをタスク成功率だけでなく、SEC提出書類やAIS傷害報告などの規制・財務データを用いたコスト収益・損益分岐分析で評価する初の物理ベース経済ベンチマークを提案し、既存手法がいずれも経済的に成立しないことを示した。
- D2E: デスクトップデータによる視覚-行動事前学習のスケーリングと身体性AIへの転移VLA2025/10/1
デスクトップのゲーム操作データを大規模に収集・圧縮し、汎用逆動力学モデルで疑似ラベル付けして事前学習することで、ロボットの操作・ナビゲーションタスクへ転移可能な基盤モデルを構築した。
- CANVAS: 常識を考慮した直感的な人間-ロボットインタラクションのためのナビゲーションシステムナビゲーション2024/10/1
視覚と言語の指示を組み合わせ、模倣学習により常識を考慮したナビゲーションを実現するフレームワークCANVASを提案し、シミュレーションと実世界で有効性を示した。
- CLARA: Classifying and Disambiguating User Commands for Reliable Interactive Robotic Agents2023/6/1
- Zero-shot Active Visual Search (ZAVIS): Intelligent Object Search for Robotic Assistants2022/9/1