Xinqi Liu
Hunan University
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAVLA/操作学習ナビゲーション視覚オドメトリ多物体追跡
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniTrackPLA:指示に基づくナビゲーションと動的人物追跡のための統合パノラマ・言語・行動モデルVLA2026/10/1
全方位パノラマ観測を活用し、言語指示ナビゲーションと人物追跡を単一モデルで行う統合VLAを提案。行動予測の一貫性検証により再計画を可能にし、シミュレーションと実環境で性能を向上させた。
- TFP: 時間条件付きメモリ融合ポリシーによる視覚運動学習VLA/操作学習2026/7/1
視覚言語行動(VLA)ポリシーは反応的で、段階依存の操作タスクで失敗する問題を解決するため、時間条件付きメモリ融合ポリシー(TFP)を提案。液体時定数ダイナミクスでタスク進行の信念を維持し、フローマッチング行動デコーダに適応変調で注入することで、LIBERO等で成功率を向上させた。
- EA-Nav: 身体性を考慮した安全な視覚ナビゲーションポリシーの学習ナビゲーション2026/7/1
異なる身体性を持つエージェント間でのナビゲーション性能を向上させるため、模倣学習に基づく身体性認識フレームワークを提案し、身体形状を条件付けトークンとして導入して行動の曖昧性を低減し、軌道拡張で高リスクサンプルを生成して安全なナビゲーションを実現した。
- MVOFormer: ロバストな単眼視覚オドメトリのためのフロー意味トランスフォーマー視覚オドメトリ2026/6/15
単眼視覚オドメトリのための新しいトランスフォーマーフレームワークを提案し、幾何学的動きと意味情報を融合して動的物体を区別し、ゼロショット汎化性能を向上させた。
- CylindTrack:パノラマ多物体追跡のための深度対応円筒運動モデリング多物体追跡2026/6/1
パノラマ映像における多物体追跡(MOT)の課題を解決するため、円筒座標系と深度情報を活用した追跡フレームワークCylindTrackを提案した。