Shengyi Qian
収録論文 4本 ・ フィジカルAI/ロボット学習
3D-LLMマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 3D-GRAND: 接地精度が高く幻覚の少ない3D-LLM向け100万規模データセット3D-LLM2024/6/1
家庭内3Dシーン4万件と言語指示620万件を対応付けた大規模データセットを構築し、3D-LLMの指示チューニングで接地能力向上と幻覚低減を実現、幻覚評価ベンチマーク3D-POPEも提案した。
- 3D-MVP: ロボットマニピュレーションのための3Dマルチビュー事前学習マニピュレーション2024/6/1
マスク付きオートエンコーダを用いて大規模3Dデータセットで視覚エンコーダを事前学習し、ロボットマニピュレーションの汎化性能を向上させる手法を提案した。
- AffordanceLLM: Grounding Affordance from Vision Language Models2024/1/1
- LLM-Grounder: Open-Vocabulary 3D Visual Grounding with Large Language Model as an Agent2023/9/1