Ran Yi
収録論文 7本 ・ フィジカルAI/ロボット学習
シーン生成世界モデルビデオ生成シミュレーション/自己中心視点
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 配置と可動性を超えて:身体化インタラクションのための使用駆動型コードシーンシーン生成2026/8/19
室内シーン生成において、物体の配置や可動性だけでなく、機能的な使用法をモデル化するフレームワークRoomWrightを提案。各アンカーをタスク中心とし、必要な物体とそのアフォーダンスを推論し、コードエージェントがインタラクションをトリガー・条件・効果のルールにコンパイルして因果関係を更新する。
- ワールドモデリングはどこへ向かうのか?世界モデル2026/8/1
エージェントの継続的改善のための世界モデルの概念を、物理状態遷移からエージェント中心の情報遷移へと拡張し、6つのプロキシ形式と3つの活用レベルを提案する。
- MetaWorld: 単一視点ビデオデータからのマルチエージェントビデオワールドモデルのスケーリングビデオ生成2026/6/1
単一視点のビデオから、複数エージェントが共有する3D空間で一貫したビデオを生成するマルチエージェントビデオワールドモデルを提案した。カメラ軌跡分解とクロスアテンションによる世界状態整合で、データ不足と視点間の整合性問題を解決する。
- EgoSim: 身体化インタラクション生成のための自己中心的世界シミュレータシミュレーション/自己中心視点2026/4/1
自己中心視点の動画から3Dシーン状態を更新しながら、空間的に一貫したインタラクション動画を生成する閉ループ型シミュレータを提案。大規模単眼動画からのデータパイプラインと低コスト収集システムも導入。
- MesaTask: 3D空間推論によるタスク駆動型卓上シーン生成シーン生成2025/9/1
タスク指示から物理的に妥当な卓上シーンを生成するため、空間推論チェーンとDPOで強化したLLMフレームワークMesaTaskを提案し、大規模データセットMesaTask-10Kを構築した。
- PCKRF: Point Cloud Completion and Keypoint Refinement With Fusion Data for 6D Pose Estimation2022/10/1
- A Configuration-Space Decomposition Scheme for Learning-based Collision Checking2019/11/1