JEPAとは
JEPA(Joint Embedding Predictive Architecture)は、Yann LeCunらが提唱する自己教師あり学習の枠組みです。入力データ(画像や動画)の一部をマスクし、その周辺情報から欠落部分の表現を予測するように学習します。
何が重要か
JEPAは、ピクセル単位の再構成ではなく、抽象的な表現空間での予測を行うため、ノイズに強く、高次な特徴を捉えられます。これにより、ロボットが環境を理解し、行動を計画するための基盤となる世界モデルの構築に貢献します。
世界のフィジカルAIを、日本語で。
じぇーぱ
別名: V-JEPA / Joint Embedding Predictive Architecture
画像や動画の一部を隠して予測することで、世界の構造を学ぶ自己教師あり学習の枠組み。
JEPA(Joint Embedding Predictive Architecture)は、Yann LeCunらが提唱する自己教師あり学習の枠組みです。入力データ(画像や動画)の一部をマスクし、その周辺情報から欠落部分の表現を予測するように学習します。
JEPAは、ピクセル単位の再構成ではなく、抽象的な表現空間での予測を行うため、ノイズに強く、高次な特徴を捉えられます。これにより、ロボットが環境を理解し、行動を計画するための基盤となる世界モデルの構築に貢献します。
週に1度、その週のフィジカルAIをまとめて送ります。重要ニュース5本・日本/中国・Research Picks・今週の公募。無料、いつでも解除できます。