Meta ha presentado oficialmente su nuevo modelo insignia de generación de imágenes, Muse Image, y también ha mostrado por primera vez una versión temprana de su generador de video Muse Video. Ambas soluciones han sido desarrolladas por la división Meta Superintelligence Labs y representan un avance significativo en el ámbito de la creación de contenido mediante inteligencia artificial.

Muse Image ya está disponible para los usuarios en Estados Unidos a través de la aplicación Meta AI, la versión web meta.ai, Instagram Stories y, parcialmente, en WhatsApp. Según la compañía, es el modelo de generación de imágenes más avanzado hasta la fecha. Su principal diferencia radica en la alta precisión para seguir indicaciones, la capacidad de editar imágenes ya creadas y la construcción de escenas a partir de múltiples referencias. Se ha puesto un énfasis especial en la integración del contexto social de Instagram, lo que permite al modelo generar contenido más relevante y personalizado.

La arquitectura de Muse Image se basa en el principio de un modelo agente: es capaz de realizar búsquedas en internet de forma autónoma, utilizar herramientas para escribir y ejecutar código, así como refinar la imagen durante el proceso de generación. Esto la convierte no solo en un generador, sino en un asistente completo para tareas creativas.

Además, Muse Image está integrado con otro modelo, Muse Spark. La combinación de estas dos IA permite crear GIF animados, sitios web completos con imágenes integradas e incluso juegos visuales interactivos, utilizando tanto la generación de medios como la escritura de código.

Muse Video: un adelanto del futuro

Paralelamente, Meta mostró un adelanto temprano de Muse Video. El modelo se basa en la misma base preentrenada que Muse Image, lo que garantiza una alta calidad visual y soporte nativo para audio. La compañía reconoce que la versión final aún está en desarrollo: los esfuerzos principales se centran actualmente en la sincronización de audio y video, así como en la representación físicamente precisa de movimientos rápidos.

Protección de derechos de autor y posicionamiento en el mercado

Meta ha implementado en Muse Image un sistema de marcas de agua invisibles llamado Content Seal. Según la compañía, la marca se mantiene incluso después de recortar, comprimir, cambiar el tamaño o hacer una captura de pantalla. En el futuro, se planea extender esta protección también al video.

Según las métricas de Arena, Muse Image ocupa el segundo lugar en las categorías de text-to-image, edición de una sola imagen y edición de múltiples imágenes, solo superado por GPT Image 2. Esto confirma la sólida competitividad de la solución de Meta en el mercado de las IA generativas.

Opinión de expertos de Cryptalist: El lanzamiento de Muse Image y el anuncio de Muse Video no son solo actualizaciones más, sino un movimiento estratégico de Meta para capturar cuota de mercado en el segmento de herramientas creativas de IA. De particular interés es la arquitectura agente de Muse Image, que podría convertirse en la base para futuros asistentes de IA autónomos. Sin embargo, el desafío clave es llevar Muse Video a un nivel competitivo, especialmente en el ámbito de la simulación física del movimiento, donde los modelos de OpenAI y Runway mantienen por ahora una ventaja.