
V-JEPA: el modelo de Meta que predice el mundo físico a partir de vídeo
V-JEPA (Video Joint Embedding Predictive Architecture) es el modelo con el que Meta AI dio en febrero de 2024 un paso hacia la visión de Yann LeCun de una inteligencia de máquina más parecida a la humana. Su objetivo no era generar vídeo, sino algo más difícil: detectar y entender cómo interactúan los objetos entre sí en el mundo físico,














