Yanbin Hu
Xi'an Jiaotong University
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 重要な場所を見る:視覚言語行動モデルのための適応的視覚精緻化VLA2026/8/3
VLAモデルの視覚エンコーダに生じる注意アーティファクトを修正し、不確実性に基づいて高解像度の局所精緻化を行うフレームワークAtVLAを提案した。
- Look Where It Matters: Adaptive Visual Refinement for Vision-Language-Action Models2026/8/1
- ECHO: Continuous Hierarchical Memory for Vision-Language-Action Models2026/5/1