Yanxiang Ma
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA/圧縮
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 重要なものを見る:汎用視覚言語行動モデルのための微分可能グリッドサンプル刈り込みVLA/圧縮2026/5/1
視覚言語行動モデルの計算コストを削減するため、タスクに応じて視覚トークンを連続的に再サンプリングする微分可能グリッドサンプラを提案。10%未満のトークンで精度を保ちつつFLOPsを76%削減。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
視覚言語行動モデルの計算コストを削減するため、タスクに応じて視覚トークンを連続的に再サンプリングする微分可能グリッドサンプラを提案。10%未満のトークンで精度を保ちつつFLOPsを76%削減。