Chengbin Du
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAVLA/圧縮
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- StellaVLA: 汎用視覚言語行動モデルのための文脈内構造化デモンストレーションVLA2026/8/1
StellaVLAは、テスト時に単一の構造化デモンストレーションを条件付けすることで、分布外の状況でも適応できる視覚言語行動モデルを提案する。
- 重要なものを見る:汎用視覚言語行動モデルのための微分可能グリッドサンプル刈り込みVLA/圧縮2026/5/1
視覚言語行動モデルの計算コストを削減するため、タスクに応じて視覚トークンを連続的に再サンプリングする微分可能グリッドサンプラを提案。10%未満のトークンで精度を保ちつつFLOPsを76%削減。