Zhiyang Li
Shanghai Jiao Tong University
収録論文 4本 ・ フィジカルAI/ロボット学習
VLAVLA/エッジ展開/高速化VLA/ロバスト性/メモリ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 速いだけでは不十分?ベンチマークのバグと設計上の制約が視覚言語行動アクセラレーションの評価を歪めるVLA2026/9/29
VLAポリシーの高速化手法を評価するシミュレーションベンチマークに潜むバグと設計上の制約を監査し、22件のバグと4件の制約を特定して、修正が手法の順位を逆転させうることを示した。
- rMuscle: 効率的な視覚-言語-行動モデル推論のためのロボット筋肉記憶VLA2026/9/16
反復作業における実行間の類似性を利用した二段階キャッシュでVLAモデルの推論を高速化し、1.29〜1.42倍の速度向上を実現した。
- XPU上でのVision-Language-Actionモデルの特性評価:オンボット展開のための制約と高速化VLA/エッジ展開/高速化2026/4/1
ロボット制御用のVLAモデルを、コスト・エネルギー・時間の観点で様々なエッジアクセラレータ上で評価し、推論の二相パターンを特定して、DP-CacheとV-AEFusionによる高速化手法を提案した。
- RoboHarness:メモリ拡張型ポリシーハーネスによる視覚言語行動モデルの文脈内適応ロバスト性向上VLA/ロバスト性/メモリ2026/3/1
凍結したVLAモデルを微調整なしでロバスト化するため、デュアルメモリRAGとマルチモーダルLLMによる帰属駆動オーケストレータ、MCP介入を備えたオンラインパイプラインと、オフラインのメモリ統合を提案し、平均成功率を56.6%向上させた。