Wei Huang
The University of Hong Kong
収録論文 9本 ・ フィジカルAI/ロボット学習
所属歴(論文より): The University of Hong Kong(〜2026) / Peking University(〜2026)
動画生成VLA軌道予測ワールドモデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LongLive-Plug: 動画生成のための一度きりの蒸留フレームワーク動画生成2026/9/29
ベースモデルにLoRAとして再利用可能な能力を学習させ、下流モデルに訓練不要でプラグアンドプレイ展開できる蒸留手法を提案。
- D$^2$-VLA:長期動的マニピュレーションのための二重記憶・二重周波数視覚言語行動モデルVLA2026/9/28
事前学習済みVLAのKVキャッシュに二重記憶と二重周波数制御を組み込み、動く物体を扱う長期タスクで過去の視覚手がかりを保持しつつ応答できるようにした。
- HIL-UMI: ユニバーサルマニピュレーションインターフェースへのVLAモデルのヒューマン・イン・ザ・ループ事後学習の導入VLA2026/9/17
ロボットを使わずにハンドヘルドUMIデモ中に方策を照会し、Energy Scoreで分布外状態を検出してデータ収集を促し、アドバンテージ推定器を更新してVLAモデルを事後学習する枠組みを提案。
- 小型VLAモデルに「どこを見るか」と「どう動くか」を教えるVLA2026/7/1
小型の視覚言語行動モデルに、空間的接地と行動生成の能力を効率的に教えるフレームワークXS-VLAを提案。蒸留とフローマッチングにより、実時間制御に適した小型モデルの性能を大幅に向上させた。
- 条件付き軌道予測についての対話軌道予測2026/4/1
周囲エージェントの軌道予測に自己エージェントの動作を組み込み、時間領域間で意図情報を補完・統合する手法CiTを提案し、既存手法を上回る性能を達成した。
- プリミティブ身体性ワールドモデルの学習:スケーラブルなロボット学習に向けてワールドモデル2025/8/1
動画生成ベースの身体性ワールドモデルを固定短時間のプリミティブ動作に限定し、言語と動作の細粒度対応・データ効率・推論速度を改善するPEWMを提案。VLMプランナとヒートマップ誘導で閉ループ制御と長期タスクへの組合せ汎化を実現する。
- DaFoEs: Mixing Datasets towards the generalization of vision-state deep-learning Force Estimation in Minimally Invasive Robotic Surgery2024/1/1
- Reliability Assessment and Safety Arguments for Machine Learning Components in System Assurance2021/12/1
- Formal Verification of Robustness and Resilience of Learning-Enabled State Estimation Systems2020/10/1