Seoyoung Lee
The University of Texas at Austin
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAアフォーダンス推論sim2realGUI自動化
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- もし、ならば、そうでなければ:視覚言語ナビゲーションにおける条件分岐の診断VLA2026/8/18
視覚言語ナビゲーションエージェントの条件分岐能力を診断するためのベンチマークCondVLNを導入し、分岐条件をシーングラフに基づいて生成し、エージェントの失敗原因を分析した。
- 物体が「何であるか」ではなく「何を可能にするか」:アフォーダンス推論のための機能的潜在空間アフォーダンス推論2026/6/1
外見ではなく機能(アフォーダンス)に基づく潜在空間を導入し、ロボットのプランニングにおける物体の機能推論を可能にする手法A4Dを提案した。
- どこに展開するかを見る:空中から地上への隠れた空間検査のためのメトリックRGBベースの走行可能性解析sim2real2026/3/1
UAVがUGVを隠れた空間に投入するため、RGB画像からメトリックな幾何・意味再構成を行い、展開可能領域を評価する枠組みを提案した。
- IntentCUA: コンピュータ操作エージェントのための意図レベル表現によるスキル抽象化とマルチエージェント計画VLA2026/2/1
コンピュータ操作エージェント向けに、意図レベルの表現でスキルを抽象化し共有メモリ上で複数エージェントが協調するフレームワークを提案し、長期的タスクの成功率と効率を改善した。
- Log2Plan: タスクマイニングを統合した適応型GUI自動化フレームワークGUI自動化2025/9/1
ユーザー行動ログからタスクをマイニングし、二段階の計画立案とリアルタイムGUI解釈を組み合わせることで、UI変化に強く長期的なタスクもこなせるGUI自動化フレームワークを提案した。