Meta официально запустила свою новейшую модель генерации изображений Muse Image и впервые продемонстрировала раннее превью Muse Video. Оба решения разработаны подразделением Meta Superintelligence Labs и знаменуют собой серьезный прогресс в области ИИ-медиа.

Muse Image: агентный подход и социальный контекст

Muse Image уже доступна в приложении Meta AI, на платформе meta.ai, а также в Instagram Stories для пользователей в США и в WhatsApp в ограниченном числе стран. Meta называет её своей самой продвинутой моделью генерации изображений. Ключевое отличие — агентная архитектура: Muse Image использует поиск в интернете, инструменты для написания и выполнения кода и способна дорабатывать изображение в процессе генерации. Модель точнее следует промптам, умеет редактировать картинки и собирать сцену из нескольких референсов, а также учитывает социальный контекст Instagram.

Интеграция с Muse Spark и новые возможности

Muse Image интегрирована с Muse Spark. Связка моделей задействует код и медиагенерацию для создания анимированных GIF, веб-сайтов со встроенными изображениями и даже интерактивных визуальных игр. Это превращает генеративный ИИ из простого инструмента для создания картинок в полноценную платформу для мультимедийного творчества.

Muse Video: превью и амбиции

Параллельно Meta показала раннее превью Muse Video. По заявлению компании, модель построена на той же базе предобучения, что и Muse Image, обеспечивает высокое визуальное качество и нативно поддерживает аудио. Однако компания признаёт, что ещё дорабатывает синхронизацию аудио и видео, а также физически точную передачу быстрого движения. Это указывает на то, что полноценный запуск видеогенерации может занять ещё несколько месяцев.

Безопасность и метрики

Meta внедрила систему защиты авторских прав: все изображения, созданные с помощью Muse Image в приложении Meta AI, получают невидимый водяной знак Content Seal. По утверждению компании, он сохраняется после кадрирования, сжатия, изменения размера или создания скриншота. В будущем Meta планирует распространить эту метку и на видео.

Согласно данным внутренней платформы Arena, Muse Image занимает второе место в категориях text-to-image, single-image editing и multi-image editing, уступая только GPT Image 2 от OpenAI. Это подтверждает высокий уровень конкурентоспособности решения.

Как аналитик, я отмечаю, что агентный подход Muse Image — это эволюционный шаг вперёд. Способность модели самостоятельно использовать внешние инструменты и контекст социальной сети делает её не просто генератором, а полноценным ассистентом для творчества. Однако вопрос синхронизации аудио и видео в Muse Video остаётся критическим — без него видеогенерация будет выглядеть сырой. В целом, Meta уверенно укрепляет свои позиции в гонке генеративных ИИ, и я ожидаю, что в ближайшие кварталы мы увидим ещё более глубокую интеграцию этих моделей в экосистему компании.