Xiangbo Shu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA3D表現学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボット操作のための視覚言語行動モデルにおける二重潜在記憶VLA2026/7/1
視覚言語行動モデルに、過去の経験を潜在記憶トークンとして統合するフレームワークを導入し、長期依存タスクの性能を向上させた。
- 非位置合わせ多視点画像からの空間知能のための3D表現学習3D表現学習2026/4/12
本論文は、カメラ位置情報なしの多視点画像から3D表現を学習するフレームワークUniSplatを提案し、幾何・外観・意味の一貫性を高めるためのデュアルマスキング、粗密ガウススプラッティング、ポーズ条件付き再較正機構を導入した。