Xiangchen Liu
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DyGeoVLN: 動的幾何基盤モデルを視覚言語ナビゲーションに統合するVLA2026/3/1
静的シーンを仮定した従来手法の限界を克服するため、動的幾何基盤モデルをVLNフレームワークに統合し、3D空間表現と視覚意味推論を強化。さらに、冗長なトークンを削減する適応的解像度トークンプルーニング戦略を導入し、長期的な動的ナビゲーションの推論コストを削減する。
- FlowVLA: 視覚的思考連鎖による動作推論を用いた視覚-言語-行動モデルVLA2025/8/1
未来フレーム予測の前にオプティカルフローで動作を推論するVisual CoTを導入し、物理的に妥当な予測と高効率なロボット操作を実現した。