Xuanjing Huang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/操作VLAVLA/世界モデル/サーベイ安全性
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LIBERO-Occ: 視点想像によるシーン起因の遮蔽下での視覚言語行動モデルの評価と改善VLA/操作2026/6/9
遮蔽がある操作環境でVLAモデルの性能が低下する問題を調べ、遮蔽評価ベンチマークLIBERO-Occを導入し、補完視点を想像して行動予測に活用する手法VIMを提案した。
- 二つの橋、一つの道:身体化軌跡結合データによるVLMから汎用VLAへの変換VLA2026/6/1
視覚言語モデル(VLM)をロボット制御ポリシー(VLA)に変換する際のギャップを、ロボットの軌跡に基づく中間データ(ETCデータ)と3段階の訓練手法で段階的に橋渡しし、汎用性を高める手法を提案した論文。
- ワールドアクションモデル:身体化AIの次のフロンティアVLA/世界モデル/サーベイ2026/5/1
視覚言語行動モデルに世界モデルを統合した「ワールドアクションモデル」の概念を定義し、既存手法を分類・整理したサーベイ論文。
- 身体性AIにおける安全性:リスク、攻撃、防御のサーベイ安全性2026/5/1
身体性AIの安全性に関する研究を、知覚から計画、行動、相互作用までのパイプライン全体にわたって体系的にレビューし、攻撃と防御の多層的な分類法を提案した論文。
- FRoM-W1: 言語指示による汎用人型全身制御フレームワークVLA2026/1/1
自然言語から人型ロボットの全身動作を生成・実行する2段階フレームワークを提案し、Unitree H1/G1で動作追従精度の向上を実証した。
- VehicleWorld: 車載エージェントのための統合マルチデバイス環境VLA2025/9/1
車載システム向けに30モジュール・250 APIを備えた実行可能な環境を構築し、状態を明示的に扱うState-based Function Callを提案して従来手法より高精度・低遅延を実現した。