Meta официально представила свою новую флагманскую модель генерации изображений — Muse Image, а также впервые продемонстрировала раннюю версию видеогенератора Muse Video. Оба решения разработаны подразделением Meta Superintelligence Labs и знаменуют собой значительный шаг вперёд в области создания контента с помощью искусственного интеллекта.

Muse Image уже доступна пользователям в США через приложение Meta AI, веб-версию meta.ai, Instagram Stories и частично в WhatsApp. По заявлению компании, это самая продвинутая модель генерации изображений на сегодняшний день. Ключевое отличие — высокая точность следования промптам, возможность редактирования уже созданных картинок и сборка сцены из нескольких референсов. Особый акцент сделан на интеграции социального контекста Instagram, что позволяет модели генерировать более релевантный и персонализированный контент.

Архитектура Muse Image построена по принципу агентной модели: она способна самостоятельно осуществлять поиск в интернете, использовать инструменты для написания и выполнения кода, а также дорабатывать изображение в процессе генерации. Это делает её не просто генератором, а полноценным ассистентом для творческих задач.

Кроме того, Muse Image интегрирована с другой моделью — Muse Spark. Связка этих двух ИИ позволяет создавать анимированные GIF, полноценные веб-сайты со встроенными изображениями и даже интерактивные визуальные игры, задействуя как медиагенерацию, так и написание кода.

Muse Video: превью будущего

Параллельно Meta показала раннее превью Muse Video. Модель построена на той же предобученной базе, что и Muse Image, что обеспечивает высокое визуальное качество и нативную поддержку аудио. В компании признают, что финальная версия ещё в разработке: основные усилия сейчас направлены на синхронизацию аудио и видео, а также на физически точную передачу быстрых движений.

Защита авторских прав и рыночные позиции

Meta внедрила в Muse Image систему невидимых водяных знаков Content Seal. По утверждению компании, метка сохраняется даже после кадрирования, сжатия, изменения размера или создания скриншота. В будущем планируется распространить эту защиту и на видео.

Согласно метрикам Arena, Muse Image занимает второе место в категориях text-to-image, single-image editing и multi-image editing, уступая только GPT Image 2. Это подтверждает серьёзную конкурентоспособность решения Meta на рынке генеративных ИИ.

Экспертное мнение Cryptalist: Запуск Muse Image и анонс Muse Video — это не просто очередные обновления, а стратегический шаг Meta по захвату доли рынка в сегменте креативных ИИ-инструментов. Особый интерес представляет агентная архитектура Muse Image, которая может стать фундаментом для будущих автономных ИИ-ассистентов. Однако ключевой вызов — это доведение Muse Video до конкурентоспособного уровня, особенно в области физической симуляции движения, где модели от OpenAI и Runway пока сохраняют преимущество.