Meta presenta V-JEPA 2, el modelo con el que enseña a los robots a desenvolverse como los humanos

Según la empresa, permite a los robots interactuar con objetos y entornos desconocidos para completar tareas, aprende y realiza predicciones
El robot humanoide es una de las promesas para el futuro y la inteligencia artificial es clave. (Foto: freepik.es)

V-JEPA 2 es un nuevo modelo deentrenado con vídeos y diseñado para que laaprenda a desenvolverse en el mundo real de la misma forma que los humanos.

El nuevo modelo forma parte de los trabajos de Meta por lograr una inteligencia de máquinas avanzada (AMI) y desarrollar agentes que puedan operar en el mundo real. Es la siguiente generación de V-JEPA, que Meta presentó en febrero del año pasado como un modelo no generativo desarrollado para enseñar a las máquinas a comprender y modelar el mundo físico mediante la visualización de vídeos.

MIRA: iOS 26: qué modelos de iPhone son compatibles con el nuevo sistema operativo de Apple

V-JEPA 2 mejora las capacidades de predicción de acciones y modelado del mundo, lo que permite a los robots interactuar con objetos y entornos desconocidos para completar tareas, como explica la compañía en una nota de prensa.

Tiene 1.200 millones de parámetros y ha sido entrenado con vídeos sin necesidad de anotaciones humanas adicionales, con técnicas de aprendizaje automático avanzadas, en un proceso que consta de dos fases: un preentrenamiento sin acciones y un entrenamiento adicional condicionado por acciones.

Robot con el modelo V-JEPA 2.

Meta ha entrenado V-JEPA 2 con la base de datos de código abierto DROID y desplegado directamente en robots, que han demostrado que pueden planificar lo que van a hacer en entornos nuevos incluso con objetos que no han visto antes, y realizar acciones básicas como alcanzar, recoger un objeto y colocarlo en una nueva ubicación.

A partir de una imagen, que muestra el objetivo (dejar un vaso en una mesita), el robot planifica la forma conseguirlo, que este caso incluye dos subobjetivos: coger el vaso y moverlo. Para ello, idea “posibles futuros en un espacio latente” y selecciona el que tiene mayor probabilidad de éxito.

V-JEPA 2 aprende y realiza predicciones en una única escala temporal lo que significa que actualmente no puede realizar una tarea que implique varios pasos, como hornear un pastel. Por eso, Meta espera mejorar sus capacidades en múltiples escalas temporales y espaciales e incorporar la multimodalidad, para ampliar la predicción a sentidos distintos de la vista.

Conforme a los criterios de

Saber más
Mira también:

Más en Inteligencia Artificial

OpenAI afirma que su IA resolvió uno de los problemas más complejos de las matemáticas

“No habrá un pasado mañana si China gana la carrera de la IA”, advierte el secretario del Tesoro de EE.UU.

Estados Unidos acusa a Deepseek, Moonshot AI y otros gigantes chinos de IA de robar sus modelos

Pruebas PISA: baja comprensión lectora en alumnos estaría vinculada a nuevas tecnologías como la IA

Muse, el agente de IA que gestiona calendario, correo y finanzas, entra en fase de pruebas cerradas

Creadora de la actriz generada por IA: Tilly Norwood “no compite contra los humanos”

Contenido GEC

Contenido GEC

Contenido sugerido

Contenido GEC