Zitai Huang
収録論文 8本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA操作操作学習視覚場所認識VLA/変形物操作身体性世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MaskHarness-WAM: インスタンス接地型ハーネスによる長期的ロボットマニピュレーションマニピュレーション2026/9/17
外観が同じ複数物体を順番に操作する長期的タスクのため、サブタスク境界で対象マスクを再生成・検証し、高レベル計画と低レベル方策を繋ぐハーネスを提案。実機実験で有効性を示した。
- CSWAM: 世界行動モデルの分布外汎化のための因果意味表現の改善VLA2026/9/16
V-JEPA 2.1をベースにした因果意味エキスパートをFastWAMに追加し、見たことのない環境や物体でもロボット行動を汎化させる手法を提案。
- DSWAM: 細粒度ロボット操作のための二重システム世界行動基盤モデル操作2026/7/1
粗い指示を細かいサブタスクに分解する言語プランナーと、物理的実行に優れた世界行動モデルを組み合わせた、ロボット操作のための二重システム基盤モデルを提案した。
- 推論効率の高いワールドアクションモデルのための4次元幾何学事前知識の学習操作学習2026/7/1
ロボット操作のためのワールドアクションモデルに、動作に関連する4次元幾何学情報を注入し、推論コストを増やさずに操作性能を向上させる手法を提案した。
- PiL-World: VLAポリシーをループ内評価するためのチャンク単位ワールドモデルVLA2026/6/1
実ロボットの閉ループ評価を可能にするため、VLAポリシーのアクションチャンクに応じて将来の観測を生成するチャンク単位のワールドモデルを提案した。
- 外洋から密閉キャビンへ:海事認識とキャビン点検のためのクロスシーン視覚場所認識ProteusVPR視覚場所認識2026/6/1
船舶環境での視覚場所認識の課題に対し、2段階の検索・精密化フレームワークProteusVPRを提案し、新しい船舶搭載データセットXHZで精度を大幅に向上させた。
- DeMaVLA: 汎用変形物操作のための視覚言語行動基盤モデルVLA/変形物操作2026/5/1
変形物(衣類など)の折りたたみを多様な物体・環境で行える視覚言語行動基盤モデルを提案し、実ロボットデモと人間介入データで訓練して汎用性を実証した。
- マルチビュー軌道動画による高整合な身体性世界モデル身体性世界モデル2025/11/1
低レベル行動をカメラパラメータとカルテシアン変換でマルチビューの軌道動画に変換し、それを制御信号として未来フレームを予測する身体性世界モデルMTV-Worldを提案。マルチビューで空間情報の損失を補い、物理世界との整合性を高めた。