Lin Sun
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniFS: 視覚言語行動モデルのための統合高速-低速階層アーキテクチャVLA2026/6/1
人間の脳の多時間スケール処理に着想を得て、VLM層を更新頻度の異なるグループに階層化し、潜在ベクトル反転機構と多レベル監視戦略を導入することで、高速-低速の周波数ジレンマを解決する新しいVLAアーキテクチャを提案した。
- Dexbotic: オープンソース視覚-言語-行動ツールボックスVLA2025/10/1
複数のVLAモデルを単一環境で再現・開発できるPyTorchベースのオープンソースツールボックスを提供し、高性能な事前学習済みモデルも公開した。
- GeoVLA: 視覚言語行動モデルに3D表現を導入VLA2025/8/1
深度マップから点群を生成し、視覚言語モデルの埋め込みと統合することで、3D空間認識を強化したロボットマニピュレーション用VLAフレームワークを提案。
- MemoryVLA: ロボット操作のための視覚-言語-行動モデルにおける知覚・認知記憶VLA2025/8/1
人間の作業記憶と海馬の記憶機構に着想を得て、知覚・認知トークンを記憶バンクに蓄え再利用するVLAモデルを提案し、長期的な依存を含む操作タスクで従来手法を上回る成功率を達成した。
- Probabilistic Multi-modal Trajectory Prediction with Lane Attention for Autonomous Vehicles2020/7/1