Longteng Guo
JIUTIAN Research
収録論文 9本 ・ フィジカルAI/ロボット学習
所属歴(論文より): JIUTIAN Research(〜2026) / Institute of Automation, Chinese Academy of Sciences(〜2026)
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ワールドトークン:訓練時ワールドモデリングによる身体化ポリシーの強化VLA2026/8/10
視覚言語行動モデルに、訓練時のみ未来映像のデノイザーを接続するワールドアダプタを導入し、推論時は映像モデルを除去して効率的な行動生成を実現する手法を提案した。
- AtlasVLA: 視覚言語行動モデルのための持続的な世界・自我状態モデリングVLA2026/8/7
単眼カメラのみで長期的なタスクを遂行できるよう、視覚言語行動モデルに持続的な世界状態メモリと自我作業メモリを導入し、空間的推論を強化したフレームワークを提案した。
- World Tokens: Enhancing Embodied Policies with Training-Time World Modeling2026/8/1
- AtlasVLA: Persistent World-Ego State Modeling for Vision-Language-Action Models2026/8/1
- SurveilNav: Collaborative Object Goal Navigation with Robot and Surveillance System2026/6/1
- NavWM: A Unified Navigation World Model for Foresight-Driven Planning2026/6/1
- VeriSpace: Spatially Grounded Action Verification for Vision-Language-Action Models2026/6/1
- UrbanNav: Learning Language-Guided Urban Navigation from Web-Scale Human Trajectories2025/12/1
- FlexVLN: Flexible Adaptation for Diverse Vision-and-Language Navigation Tasks2025/3/1