Jingjing Qian
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA移動操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ELAN4D: 身体中心の4D監視による視覚言語行動モデルのプラグアンドプレイ適応VLA2026/5/1
ロボットのキーポイントの未来の3D軌跡を予測する補助分岐をVLAモデルに追加し、外乱下での汎化性能を向上させるフレームワークを提案した。
- ESCAPE: 長期的移動操作のためのエピソード空間記憶と適応実行ポリシー移動操作2026/4/1
長期的な移動操作タスクにおける破滅的忘却、空間的不整合、硬直的な実行の問題を解決するため、エピソード空間記憶と適応実行ポリシーを備えたESCAPEを提案し、ALFREDベンチマークで最先端の性能を達成した。
- GeoPredict: 予測キネマティクスと3Dガウス幾何を活用した高精度VLAマニピュレーションVLA2025/12/1
ロボットアームの将来の3Dキーポイント軌道と作業空間の3Dガウス幾何を予測するモジュールをVLAモデルに追加し、訓練時のみの監督で推論時は軽量なトークン追加だけで精度を向上させた。
- AVA-VLA: 能動的視覚注意による視覚言語行動モデルの改善VLA2025/11/1
VLAモデルを部分観測マルコフ決定過程として再定式化し、履歴を反映した再帰状態と能動的視覚注意で行動生成を改善する手法を提案。LIBEROやCALVINで最高性能を達成し、実機双腕タスクにも転移。