Juntao Gao
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AVA-VLA: 能動的視覚注意による視覚言語行動モデルの改善VLA2025/11/1
VLAモデルを部分観測マルコフ決定過程として再定式化し、履歴を反映した再帰状態と能動的視覚注意で行動生成を改善する手法を提案。LIBEROやCALVINで最高性能を達成し、実機双腕タスクにも転移。
- Compressor-VLA: 指示に基づく視覚トークン圧縮による効率的なロボットマニピュレーションVLA2025/11/1
言語指示に応じて視覚トークンを動的に圧縮する2段階の手法を提案し、VLAモデルの計算量を削減しつつLIBEROベンチマークで高い成功率と実機転移を実現した。