Meta ha lanzado oficialmente su modelo más reciente de generación de imágenes Muse Image y ha mostrado por primera vez un avance temprano de Muse Video. Ambas soluciones han sido desarrolladas por la división Meta Superintelligence Labs y representan un avance significativo en el ámbito de los medios generados por IA.

Muse Image: enfoque agéntico y contexto social

Muse Image ya está disponible en la aplicación Meta AI, en la plataforma meta.ai, así como en Instagram Stories para usuarios en Estados Unidos y en WhatsApp en un número limitado de países. Meta la describe como su modelo de generación de imágenes más avanzado. La diferencia clave radica en su arquitectura agéntica: Muse Image utiliza búsqueda en internet, herramientas para escribir y ejecutar código, y es capaz de refinar la imagen durante el proceso de generación. El modelo sigue las indicaciones con mayor precisión, puede editar imágenes y componer una escena a partir de múltiples referencias, además de tener en cuenta el contexto social de Instagram.

Integración con Muse Spark y nuevas capacidades

Muse Image está integrado con Muse Spark. La combinación de modelos utiliza código y generación de medios para crear GIF animados, sitios web con imágenes integradas e incluso juegos visuales interactivos. Esto transforma la IA generativa de una simple herramienta para crear imágenes en una plataforma completa para la creatividad multimedia.

Muse Video: avance y ambiciones

Paralelamente, Meta ha mostrado un avance temprano de Muse Video. Según la compañía, el modelo está construido sobre la misma base de preentrenamiento que Muse Image, ofrece alta calidad visual y es compatible de forma nativa con audio. Sin embargo, la empresa reconoce que aún está perfeccionando la sincronización de audio y video, así como la representación físicamente precisa del movimiento rápido. Esto indica que el lanzamiento completo de la generación de video podría llevar varios meses más.

Seguridad y métricas

Meta ha implementado un sistema de protección de derechos de autor: todas las imágenes creadas con Muse Image en la aplicación Meta AI reciben una marca de agua invisible Content Seal. Según la compañía, esta se mantiene después de recortar, comprimir, cambiar el tamaño o hacer una captura de pantalla. En el futuro, Meta planea extender esta marca también al video.

Según datos de la plataforma interna Arena, Muse Image ocupa el segundo lugar en las categorías de text-to-image, edición de una sola imagen y edición de múltiples imágenes, solo superado por GPT Image 2 de OpenAI. Esto confirma el alto nivel de competitividad de la solución.

Como analista, señalo que el enfoque agéntico de Muse Image es un paso evolutivo hacia adelante. La capacidad del modelo para utilizar de forma autónoma herramientas externas y el contexto de la red social lo convierte no solo en un generador, sino en un asistente completo para la creatividad. Sin embargo, la cuestión de la sincronización de audio y video en Muse Video sigue siendo crítica; sin ella, la generación de video parecerá tosca. En general, Meta está consolidando con confianza su posición en la carrera de la IA generativa, y espero que en los próximos trimestres veamos una integración aún más profunda de estos modelos en el ecosistema de la empresa.