Runsen Xu
収録論文 4本 ・ フィジカルAI/ロボット学習
3D視覚グラウンディング3Dシーン理解
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLM-Grounder: ゼロショット3D視覚グラウンディングのためのVLMエージェント3D視覚グラウンディング2024/10/1
2D画像のみを用いた視覚言語モデルにより、3D点群や物体事前情報なしで自然言語指示に基づく3D物体の位置推定をゼロショットで実現したフレームワーク。
- MMScan: 階層的接地言語アノテーション付きマルチモーダル3Dシーンデータセット3Dシーン理解2024/6/1
領域から物体レベルまでの階層的な言語アノテーションを備えた大規模マルチモーダル3Dシーンデータセットを構築し、3D視覚接地と質問応答のベンチマークを提供した。
- EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI2023/12/1
- CO^3: Cooperative Unsupervised 3D Representation Learning for Autonomous Driving2022/6/1