Jiahan Fan
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 適応的視覚トークンキャッシュによるVision-Language-Actionモデルの高速化学習VLA2026/2/1
VLAモデルの推論を、再利用する視覚トークンを動的に選ぶ学習可能なポリシーとして最適化し、精度を保ちながら最大1.76倍の高速化を実現した。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
VLAモデルの推論を、再利用する視覚トークンを動的に選ぶ学習可能なポリシーとして最適化し、精度を保ちながら最大1.76倍の高速化を実現した。