Alan Yuille
収録論文 10本 ・ フィジカルAI/ロボット学習
視覚推論sim2real世界モデル/ナビゲーション動画推論マニピュレーション世界モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VBVR-Pro: ネイティブ視覚推論のためのスケーラブルで検証可能なスイート視覚推論2026/8/26
視覚生成を推論の媒体として扱うネイティブ視覚推論の研究を進めるため、300の手続き生成タスクからなる閉ループテストベッドVBVR-Proを導入し、検証可能な報酬スコアラと制御されたモダリティ比較を提供する。
- エージェント型Real2Sim:視覚言語エージェントによる物理ベースの世界モデリングsim2real2026/7/1
ロボットと物体の相互作用の実世界記録を、物理シミュレーション可能な双子モデルに自動変換するフレームワークを提案。視覚言語エージェントが幾何・物理パラメータ・軌道などを自律的に推定し、剛体操作から変形物体、人型動作までを統一的に扱う。
- 3D-Belief:生成的3D世界モデリングによる身体化された信念推論世界モデル/ナビゲーション2026/5/12
部分観測から3D空間でのエージェントの信念を推定・更新する生成的3D世界モデルを提案し、シミュレーションと実世界の物体ナビゲーションタスクで有効性を示した。
- 超大規模動画推論スイート動画推論2026/2/1
200種類の推論タスクと100万本以上の動画からなる大規模データセットVBVRと、ルールベースで検証可能な評価ベンチマークVBVR-Benchを構築し、動画推論のスケーリング則と未見タスクへの汎化の兆候を示した。
- PartInstruct: 部品レベル指示による細粒度ロボットマニピュレーションのためのベンチマークマニピュレーション2025/5/1
部品レベルの指示と3Dラベル付き物体を含む大規模データセットとベンチマークを構築し、既存のロボットマニピュレーション手法を評価した。
- GenEx: 探索可能な世界を生成する世界モデル2024/12/1
1枚のRGB画像から3D一貫性のある想像上の環境を生成し、AIエージェントがその中を探索・ナビゲートできるシステムを提案。
- 生成的ワールドエクスプローラーVLA2024/11/1
エージェントが大規模3D世界を心的に探索し、想像した観測で信念を更新して意思決定に活かすフレームワークを提案。
- Learning Road Scene-level Representations via Semantic Region Prediction2023/1/1
- Probabilistic Multi-modal Trajectory Prediction with Lane Attention for Autonomous Vehicles2020/7/1
- Generation and Comprehension of Unambiguous Object Descriptions2015/11/1