Haoqian Wang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Open-UniMo: オープンワールドにおける動作と言語の統合的理解と生成に向けてVLA2026/9/13
動作と言語を同一のトークン空間で扱う大規模動作言語モデルを提案し、CoT推論と強化学習で双方向の生成・理解精度を高めた。
- M²-VLA: 層混合とメタスキルによる汎用操作のための視覚言語モデル強化VLA/操作2026/4/1
視覚言語モデルをロボット操作のバックボーンとして直接活用し、層混合戦略とメタスキルモジュールを導入して、高次意味理解と精密制御のギャップを埋める新しいVLAモデルを提案した。シミュレーションと実環境で有効性とゼロショット汎化を実証した。
- RoboWheel: 実世界の人間デモンストレーションから異形態ロボット学習用データを生成するデータエンジンVLA2025/12/1
人間の手と物体のインタラクション動画から、接触を考慮した軌道を再構成し、多様なロボット形態へ再ターゲティングして学習データを生成するデータエンジンを提案。VLAや模倣学習でテレオペ並みの性能を実証。