Xuezhi Cao
Meituan Inc.
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 2AM: 長期ホライズン操作における操縦可能な行動モデルのためのエージェント側記憶の基盤化VLA2026/9/10
マルチモーダルエージェントにタスク記憶を集約し、単一のRGBベースVLAを実行者として、履歴を言語サブタスクと2Dヒントに変換して操縦する長期操作フレームワーク。LIBERO-Memで大幅な性能向上を達成。
- LARY: 汎用視覚-行動対応のための潜在行動表現ベンチマークVLA2026/4/1
人間の行動ビデオから学習した潜在行動表現の能力を評価する統一ベンチマークを構築し、汎用視覚基盤モデルが専門の潜在行動モデルより優れ、潜在空間が物理行動空間とより良く整合することを示した。