Lei Xiao
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA移動操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 二つの橋、一つの道:身体化軌跡結合データによるVLMから汎用VLAへの変換VLA2026/6/1
視覚言語モデル(VLM)をロボット制御ポリシー(VLA)に変換する際のギャップを、ロボットの軌跡に基づく中間データ(ETCデータ)と3段階の訓練手法で段階的に橋渡しし、汎用性を高める手法を提案した論文。
- ESCAPE: 長期的移動操作のためのエピソード空間記憶と適応実行ポリシー移動操作2026/4/1
長期的な移動操作タスクにおける破滅的忘却、空間的不整合、硬直的な実行の問題を解決するため、エピソード空間記憶と適応実行ポリシーを備えたESCAPEを提案し、ALFREDベンチマークで最先端の性能を達成した。
- GeoPredict: 予測キネマティクスと3Dガウス幾何を活用した高精度VLAマニピュレーションVLA2025/12/1
ロボットアームの将来の3Dキーポイント軌道と作業空間の3Dガウス幾何を予測するモジュールをVLAモデルに追加し、訓練時のみの監督で推論時は軽量なトークン追加だけで精度を向上させた。
- AVA-VLA: 能動的視覚注意による視覚言語行動モデルの改善VLA2025/11/1
VLAモデルを部分観測マルコフ決定過程として再定式化し、履歴を反映した再帰状態と能動的視覚注意で行動生成を改善する手法を提案。LIBEROやCALVINで最高性能を達成し、実機双腕タスクにも転移。