Kaicheng Yang
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA/量子化VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HoloQ-VLA: 視覚言語行動モデルの一様W4A4量子化VLA/量子化2026/5/27
視覚言語行動モデルを、拡散アクションヘッドを含む全体を一様に4ビット量子化する訓練不要のフレームワークを提案し、性能を維持しつつメモリを大幅削減した。
- LLaVA-OneVision-2:次世代知覚知能に向けてVLA2026/5/25
動画を圧縮ビットストリームとして扱い、適応的な時間グループと空間的証拠の選択によりトークン予算を効率的に配分する新しい視覚言語モデルを提案。大規模なオープン監視データで学習し、動画理解や時間的・空間的接地、操作トレース推論などで高性能を達成。