Video Joint Embedding Predictive Architecture model that learns visual representations by predicting in latent space.
- Feb 15, 2024
- —
- video
- —
- —
- 1
Releases
Feb 15, 2024V-JEPA releasedOpen weights
Meta released V-JEPA, a video model trained by predicting missing representations rather than pixels.

