Owen Du
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLA-ACL: 行動整合性に基づく視覚トークン刈り込みによる効率的なVision-Language-ActionモデルVLA2026/10/6
ベースのVLAモデルを凍結したまま、行動レベルの教師信号で軽量な視覚トークン選択ポリシーを学習し、最大87.5%の視覚トークンを削減しつつ操作性能を維持する手法を提案。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
ベースのVLAモデルを凍結したまま、行動レベルの教師信号で軽量な視覚トークン選択ポリシーを学習し、最大87.5%の視覚トークンを削減しつつ操作性能を維持する手法を提案。