Donggang Cao
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/推論高速化VLA/量子化
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLN-Cache: 視覚・意味ダイナミクスを考慮したVLNモデルのトークンキャッシングVLA2026/3/1
VLNタスクで大規模視覚言語モデルの推論コストを削減するため、視点移動によるトークン位置ずれとタスク進行に伴う意味的変化を考慮したトークンキャッシング手法を提案した。
- KERV: 身体化VLAモデルのための運動学的修正投機的復号VLA/推論高速化2026/3/1
VLAモデルの推論を高速化するため、運動学に基づくカルマンフィルタでアクションを予測し、投機的復号の誤りを補正するフレームワークKERVを提案。誤り訂正の再推論を回避し、受容閾値を動的に調整することで、成功率をほぼ落とさずに27〜37%の高速化を達成した。
- DyQ-VLA: 身体化視覚言語行動モデルのための時間動的認識量子化VLA/量子化2026/3/1
VLAモデルの推論コストを削減するため、時間的な感度に応じてビット幅を動的に切り替える量子化フレームワークDyQ-VLAを提案した。
- HeiSD: 運動学的認識を備えた身体化視覚言語行動モデルのためのハイブリッド投機的復号VLA/推論高速化2026/3/1
VLAモデルの推論を高速化するため、ドラフタベースと検索ベースの投機的復号を統合したハイブリッド手法HeiSDを提案し、検証スキップ機構と運動学に基づく融合指標により高速化と成功率を両立した。