何が起きたか

arXivは2026-09-28、論文「Efficient World Action Model Inference with Adaptive Intermediate States」を公開した。論文は、World Action Models(WAMs)の推論を、前段の計算を捨てずに適応させる「WAMACHINE」で高速化するとしている。評価対象は3種類の代表的なWAMアーキテクチャで、LIBEROとRoboTwin 2.0で検証した。 論文によると、観測から行動までの遅延は1.47〜3.05倍短縮し、GPU推論時間は再計画あたり2.23〜3.27倍短縮した。タスク成功率は96.69〜99.54%を維持したという。

詳細

WAMACHINEは訓練不要の枠組みで、閉ループ再計画・拡散の各ステップ・Transformer層の3段階で計算を再利用する設計である。閉ループ再計画では、直前の再計画状態を次の再計画の初期値に写し替えるTrajectory Remappingを用いる。拡散ステップでは、実行中に先読み推論を行い、整合性確認を通過した場合に保持していた拡散状態を実観測に再結合するObservation Rebindingを使う。Transformer層では、保持した層状態を選択的に再スケールし、中間層のみをフル計算で更新するResidual Rescalingを採る。 補足ソースのAnyStep-WAMは、別のWAM向けに可変予算の推論と蒸留を扱っており、60.2%、49.8%、85.28%の平均デノイジングステップ削減と、1ステップ予算での成功率向上を示したとしている。

Key Facts

arXivは2026-09-28に論文「Efficient World Action Model Inference with Adaptive Intermediate States」を公開した。[1]
論文は、World Action Models(WAMs)の推論を訓練不要の枠組み「WAMACHINE」で高速化するとしている。[1]
評価は3種類の代表的なWAMアーキテクチャで、LIBEROとRoboTwin 2.0を用いて行われた。[1]
WAMACHINEは観測から行動までの遅延を1.47〜3.05倍短縮したとしている。[1]
GPU推論時間は再計画あたり2.23〜3.27倍短縮し、タスク成功率は96.69〜99.54%を維持したとしている。[1]

本紙の見方

本件の新しさは、WAMの推論を単に軽量化するのではなく、再利用可能な中間状態を状況に応じて“保持し直す”点にある。論文は、再計画・拡散ステップ・Transformer層の3層で別々の再利用機構を置いており、計算削減の対象が推論全体に分散している。つまり、主役はモデル規模の縮小ではなく、推論時の状態管理そのものだと読める。 この点は、補足ソースのAnyStep-WAMが「予算に応じてデノイジング段数を変える」発想を採っているのと並べると、WAM研究が固定回数の生成から可変予算・適応実行へ移っていることを示す。ただし、AnyStep-WAMは別の手法であり、本論文のWAMACHINEとは目的が近くても実装の焦点は異なる。WAMACHINEは、既存の推論途中状態をどこまで安全に流用できるかに踏み込んでいる点で、より実行系寄りである。 業界構造への含意としては、WAMの性能競争が単純な成功率だけでなく、観測から行動までの遅延とGPU再計画コストをどこまで落とせるかに移る可能性がある。LIBEROとRoboTwin 2.0での評価が示すのは、シミュレーション上の成功率を大きく崩さずに、推論時間の重さを下げられるかどうかである。これは、学習済みモデルを大量に再学習するより、推論エンジン側の改良が効く局面があることを示唆する。 未確定の論点は、実ロボットでの再現性、3つの再利用機構それぞれの寄与分解、整合性確認やprobe checksの失敗時にどれだけ計算が戻るのか、そして推論短縮が長時間運用で安定するかである。論文は有効性を示しているが、どのアーキテクチャやタスク条件で最も効くかまではまだ詰める余地がある。

なぜ重要か

WAMの推論遅延が1.47〜3.05倍短縮できるなら、行動決定の待ち時間が支配的な制御ループでは適用条件の検討余地がある。論文が示す3層の状態再利用は、WAMを「高精度だが重い」から「実行時に調整できる」方向へ寄せる提案である。