Zijian Wang
収録論文 10本 ・ フィジカルAI/ロボット学習
3D変化検出VLA3D生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ShelfChange3D: 小売棚監視のための物体レベル3D変化検出3D変化検出2026/10/1
RGB-D観測のペアから棚の商品変化を物体レベルの3Dバウンディングボックスで検出するタスクを定式化し、大規模データセットと幾何補正を組み込んだエンドツーエンド手法を提案した。
- 共同訓練か後で統合か?共有アクションインターフェースによるVLAエキスパートの統合VLA2026/9/27
タスクごとに独立訓練したVLAエキスパートを、アクションインターフェースを共通化した上でLoRA更新と文脈誘導型スパースマージにより統合し、マルチタスク性能を向上させる手法を提案。
- StellaVLA: 汎用視覚言語行動モデルのための文脈内構造化デモンストレーションVLA2026/8/1
StellaVLAは、テスト時に単一の構造化デモンストレーションを条件付けすることで、分布外の状況でも適応できる視覚言語行動モデルを提案する。
- ABot-Earth 0.5: 生成型3D地球モデル3D生成2026/6/8
衛星画像から広大な3D環境を生成する生成モデルを提案し、3Dガウススプラッティングを用いてリアルな都市景観を高速に合成する。
- アフォーダンス場介入:ロボットマニピュレーションにおけるVLAの記憶トラップからの脱出VLA2025/12/1
VLAモデルが未知環境で記憶した軌道に固執する「記憶トラップ」を固有感覚で検知し、3D空間アフォーダンス場をプラグインとして用いて軌道を修正する軽量ハイブリッド手法を提案。
- MergeVLA: スキル横断モデルマージによる汎用視覚言語行動エージェントVLA2025/11/1
異なるタスクで訓練したVLAエキスパートを統合する際の非マージ性の原因を分析し、タスクマスク付きLoRAとクロスアテンションのみの行動エキスパートで設計段階からマージ可能にしたVLAアーキテクチャを提案。
- An Explicit Method for Fast Monocular Depth Recovery in Corridor Environments2023/9/1
- Robust, High-Precision GNSS Carrier-Phase Positioning with Visual-Inertial Fusion2023/3/1
- Distributed Motion Control for Multiple Connected Surface Vessels2020/7/1
- Out-of-focus: Learning Depth from Image Bokeh for Robotic Perception2017/5/1