Zetian Xu
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA/操作操作継続学習/VLAVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SAM3Dガイドによる物体中心表現アライメントを用いた視覚言語行動モデルVLA/操作2026/7/1
VLAモデルにSAM3Dを教師として物体中心の3D表現を学習させ、推論時はRGBのみで高精度な操作を実現する手法を提案。
- HiMem-WAM: ロボット操作のための階層的メモリゲート型ワールドアクションモデル操作2026/6/1
長期的なロボット操作タスクにおける記憶保持の問題を解決するため、階層的な潜在アクションと境界トリガー型メモリ更新を統合したワールドアクションモデルを提案した。
- 視覚言語行動モデルは実世界データから忘れずに継続学習できるか?継続学習/VLA2026/5/1
実世界のロボット連続操作タスクでVLAモデルの継続学習を検証し、経験再生が破滅的忘却を防ぎ、ジョイント訓練と同等以上の性能を達成することを示した。
- AIM: 空間価値マップを用いた意図認識型統合世界行動モデリングVLA2026/4/1
事前学習済みのビデオ生成モデルを基盤に、将来の観測と空間価値マップを共同で予測し、意図認識型の注意機構と自己蒸留強化学習によりロボットの行動生成を高精度化する手法を提案した。
- AtomVLA: 予測的潜在世界モデルによるロボット操作のためのスケーラブルなポストトレーニングVLA/操作2026/3/1
VLAモデルの長期的なタスク実行における指示の粒度不足による誤差蓄積を解決するため、大規模言語モデルでタスクを細分化し、予測的世界モデルで潜在空間内のサブタスク達成度を評価する新しいフレームワークを提案した。