Apple está trabajando en MM1, su modelo de IA que admite hasta 30.000 millones de parámetros

El modelo puede razonar con pocas instrucciones para aprender texto y procesar varias imágenes
Apple está trabajando en MM1, su modelo de IA que admite hasta 30.000 millones de parámetros.

ha trabajado en una familia de modelos de lenguaje de gran tamaño multimodal (MLLM, por sus siglas en ingles) denominada MM1, que demuestra tener capacidad de razonar en una cadena de pensamiento de pocas indicaciones para el aprendizaje de texto y el razonamiento de múltiples imágenes.

MM1 es una familia de modelos multimodales que ha entrenado un equipo de Apple. Admite hasta 30.000 millones de parámetros, con variantes tanto de modelos densos como de modelo de mezcla de expertos, en el que se ha seguido un preentrenamiento a gran escala con un un ajuste supervisado posterior basado en experimentos entrenados.

MIRA: China propone una ley de inteligencia artificial centrada en la industria y la seguridad

Este tipo de preentrenamiento permite que MM1 realice predicciones en contexto y demuestre razonamiento en imágenes múltiples y en cadena de pensamiento de pocas indicaciones. Esto es, desde realizar funciones matemáticas básicas y seguir instrucciones y razonamiento a través de las imágenes a demostrar sentido común y conocimiento de palabras sobre objetos cotidianos, como explican en el texto de la investigación publicado en Arxiv.

En la base de esta familia de modelos se encuentra el estudio de la importancia de los componentes de arquitectura y la elección de datos, así como de los codificadores de imágenes y el conector de lenguaje de visión.

La finalidad de esta investigación es la construcción de un modelo de lenguaje grande multimodal de alto rendimiento, con el que esperan “ayudar a la comunidad a construir modelos sólidos más allá de la cualquier modelo específico, arquitectura o estrategia de datos”.

Conforme a los criterios de

Saber más
Más en Inteligencia Artificial

¿Qué está pasando con la inteligencia artificial? De la “conspiración enfermiza” de Trump al riesgo para la humanidad que advierte la ONU

Director de Anthropic pide desaceleración inmediata en desarrollo de la IA, y recibe el respaldo de OpenAI y SpaceXAI

Qué es Muse: así funciona el nuevo agente de IA de Meta que puede comprar, reservar viajes y enviar correos

¿Código abierto o código cerrado? El gran debate sobre la IA y cuál podría ser el camino para Perú

La ONU advierte que todos los derechos humanos “están en riesgo” ante el avance de la IA

Donald Trump califica de “fuerzas negativas” a quienes piden regular la IA y dice que “no sucederá”

Contenido GEC

Contenido GEC

Contenido sugerido

Contenido GEC