Zhen Luo
収録論文 7本 ・ フィジカルAI/ロボット学習
軌道予測3D生成シーン生成マニピュレーションsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DreamTraj: 未レンダリングのビデオ拡散潜在表現を読み取る6自由度物体軌道生成軌道予測2026/8/1
単一のRGB画像と指示文から、ビデオ生成モデルの内部表現を直接読み取って物体の6自由度軌道を予測する手法を提案。専用データセットMOVEも構築し、既存手法より高速で高精度。
- コードとしての部屋:エージェント的コード合成による俯瞰画像からの3D部屋生成3D生成2026/5/18
俯瞰画像から3D部屋を生成するため、MLLMベースのエージェントがBlenderコードを段階的に合成するフレームワークを提案。記憶モジュールで文脈忘却を防ぎ、専用ベンチマークで有効性を検証した。
- STABLE: セマンティクスと物理の二重システムによるシミュレーション対応テーブルトップレイアウト生成シーン生成2026/5/1
タスク指示からシミュレーション可能なテーブルトップシーンを生成するため、意味推論と物理補正を交互に行う二重システムを提案した。
- MesaTask: 3D空間推論によるタスク駆動型卓上シーン生成シーン生成2025/9/1
タスク指示から物理的に妥当な卓上シーンを生成するため、空間推論チェーンとDPOで強化したLLMフレームワークMesaTaskを提案し、大規模データセットMesaTask-10Kを構築した。
- RoboReflect: 曖昧な状態の物体把持のためのロボット自己内省推論フレームワークマニピュレーション2025/1/1
大規模視覚言語モデル(LVLM)を活用し、把持失敗時にロボットが自己内省して戦略を自動修正・記憶するフレームワークを提案。曖昧な状態の物体8種で既存手法を上回る性能を示した。
- InfiniteWorld: 汎用視覚言語ロボットインタラクションのための統合スケーラブルシミュレーションフレームワークsim2real2024/12/1
Nvidia Isaac Sim上に構築された、汎用視覚言語ロボットインタラクション向けの統合スケーラブルなシミュレータを提案し、3Dアセット構築やReal2Sim、自動注釈などの機能と4つの新しいベンチマークを提供する。
- PCPNet: An Efficient and Semantic-Enhanced Transformer Network for Point Cloud Prediction2023/4/1