Meta официально представила свою новую флагманскую модель генерации изображений — Muse Image, а также впервые продемонстрировала раннюю версию видеогенератора Muse Video. Оба решения разработаны подразделением Meta Superintelligence Labs и знаменуют собой значительный шаг вперёд в области создания контента с помощью искусственного интеллекта.
Muse Image уже доступна пользователям в США через приложение Meta AI, веб-версию meta.ai, Instagram Stories и частично в WhatsApp. По заявлению компании, это самая продвинутая модель генерации изображений на сегодняшний день. Ключевое отличие — высокая точность следования промптам, возможность редактирования уже созданных картинок и сборка сцены из нескольких референсов. Особый акцент сделан на интеграции социального контекста Instagram, что позволяет модели генерировать более релевантный и персонализированный контент.
Архитектура Muse Image построена по принципу агентной модели: она способна самостоятельно осуществлять поиск в интернете, использовать инструменты для написания и выполнения кода, а также дорабатывать изображение в процессе генерации. Это делает её не просто генератором, а полноценным ассистентом для творческих задач.
Кроме того, Muse Image интегрирована с другой моделью — Muse Spark. Связка этих двух ИИ позволяет создавать анимированные GIF, полноценные веб-сайты со встроенными изображениями и даже интерактивные визуальные игры, задействуя как медиагенерацию, так и написание кода.
Muse Video: превью будущего
Параллельно Meta показала раннее превью Muse Video. Модель построена на той же предобученной базе, что и Muse Image, что обеспечивает высокое визуальное качество и нативную поддержку аудио. В компании признают, что финальная версия ещё в разработке: основные усилия сейчас направлены на синхронизацию аудио и видео, а также на физически точную передачу быстрых движений.
Защита авторских прав и рыночные позиции
Meta внедрила в Muse Image систему невидимых водяных знаков Content Seal. По утверждению компании, метка сохраняется даже после кадрирования, сжатия, изменения размера или создания скриншота. В будущем планируется распространить эту защиту и на видео.
Согласно метрикам Arena, Muse Image занимает второе место в категориях text-to-image, single-image editing и multi-image editing, уступая только GPT Image 2. Это подтверждает серьёзную конкурентоспособность решения Meta на рынке генеративных ИИ.
Экспертное мнение Cryptalist: Запуск Muse Image и анонс Muse Video — это не просто очередные обновления, а стратегический шаг Meta по захвату доли рынка в сегменте креативных ИИ-инструментов. Особый интерес представляет агентная архитектура Muse Image, которая может стать фундаментом для будущих автономных ИИ-ассистентов. Однако ключевой вызов — это доведение Muse Video до конкурентоспособного уровня, особенно в области физической симуляции движения, где модели от OpenAI и Runway пока сохраняют преимущество.