Wenxuan Wang
収録論文 5本 ・ フィジカルAI/ロボット学習
セグメンテーションVLA/操作VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 画像条件付きインスタンスプロンプトネットワークによる参照リモートセンシング画像セグメンテーションセグメンテーション2026/5/23
リモートセンシング画像の参照セグメンテーションにおいて、画像条件付きインスタンスプロンプトと双方向情報融合を導入し、クロスモーダル特徴融合のボトルネックを解消する新しいネットワークを提案した。
- ST-VLA: 汎用ロボット操作のための4D認識時空間理解の実現VLA/操作2026/3/1
ロボット操作のための階層型VLAフレームワークST-VLAを提案し、3D-4D表現で知覚と行動を橋渡し、大規模データセットST-Humanで訓練した。RLBenchと実世界で成功率を大幅に向上させた。
- 階層的マニピュレーション政策のための世界モデルのスケーリングVLA2026/2/1
大規模事前学習済み世界モデルを高レベルプランナーとして用い、VLAを低レベル実行者とする階層的フレームワークを提案。未知物体や新規状況での汎化性能を大幅に向上させた。
- 統一視覚言語行動モデルVLA2025/6/1
視覚・言語・行動を離散トークン列として自己回帰的にモデル化し、大規模動画から因果ダイナミクスを学習する統合VLAモデルUniVLAを提案。
- Fixed-Dimensional and Permutation Invariant State Representation of Autonomous Driving2021/5/1