何が起きたか

zjw4321.github.ioは2026年7月9日に、VLAモデルの推論を効率化する神経内省ゲートを提案する記事を掲載した。このゲートはデコード中のロジットマージンを監視し、モデルが不確実な場合にのみ再計算を行う。

なぜ重要か

VLAモデルを使うロボット制御では、デコード中の行動候補の差が小さくなったときだけキャッシュを外して再計算するため、把持や位置合わせのように判断が揺れやすい局面で誤った再利用を避けられます。提案元は、静止して見える画面でも、こうした場面では新しい前向き計算が必要になりうるとしています。