Xicheng Gong
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA身体化指示追従身体化AI/データセット
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniWAM:統合された世界行動モデルVLA2026/10/1
物理推論・映像生成・行動予測を統合したモデルで、人間の一人称視点データとロボットデータを活用し、複数の評価でSOTAを達成した。
- RePlan-Bot: 身体化指示追従のためのマルチレベル再計画身体化指示追従2026/5/1
長期的な計画と不可逆な状態変化に対応するため、高レベル監査、常識検索、低レベル修正を統合した再計画エージェントを提案し、ALFREDベンチマークで最高性能を達成した。
- RotVLA: 回転潜在アクションを用いた視覚言語行動モデルVLA2026/5/1
連続的な回転群SO(n)上の潜在アクション表現を導入し、離散量子化の問題を解決したVLAモデルを提案。大規模データで事前学習し、下流タスクで高い性能を達成。
- 身体化質問応答を認識から意思決定へ拡張する身体化AI/データセット2026/5/1
身体化環境での認識・推論・相互作用を統合評価する大規模データセットEQA-DecisionとベースラインモデルRoboDecisionを提案した論文。
- NavQ: 先見性を持つ視覚と言語によるナビゲーションのためのQモデル学習VLA2025/10/1
大規模な未ラベル軌道データからQ学習でQモデルを訓練し、将来の情報を考慮した視覚と言語によるナビゲーションを実現する手法を提案。