Meta офіційно представила свою нову флагманську модель генерації зображень — Muse Image, а також вперше продемонструвала ранню версію відеогенератора Muse Video. Обидва рішення розроблені підрозділом Meta Superintelligence Labs і знаменують собою значний крок вперед у сфері створення контенту за допомогою штучного інтелекту.

Muse Image вже доступна користувачам у США через застосунок Meta AI, веб-версію meta.ai, Instagram Stories та частково у WhatsApp. За заявою компанії, це найпросунутіша модель генерації зображень на сьогоднішній день. Ключова відмінність — висока точність дотримання промптів, можливість редагування вже створених зображень та збірка сцени з кількох референсів. Особливий акцент зроблено на інтеграції соціального контексту Instagram, що дозволяє моделі генерувати більш релевантний та персоналізований контент.

Архітектура Muse Image побудована за принципом агентної моделі: вона здатна самостійно здійснювати пошук в інтернеті, використовувати інструменти для написання та виконання коду, а також доопрацьовувати зображення в процесі генерації. Це робить її не просто генератором, а повноцінним асистентом для творчих завдань.

Крім того, Muse Image інтегрована з іншою моделлю — Muse Spark. Зв'язка цих двох ШІ дозволяє створювати анімовані GIF, повноцінні веб-сайти з вбудованими зображеннями і навіть інтерактивні візуальні ігри, задіюючи як медіагенерацію, так і написання коду.

Muse Video: прев'ю майбутнього

Паралельно Meta показала раннє прев'ю Muse Video. Модель побудована на тій самій попередньо навченій базі, що й Muse Image, що забезпечує високу візуальну якість та нативну підтримку аудіо. У компанії визнають, що фінальна версія ще в розробці: основні зусилля зараз спрямовані на синхронізацію аудіо та відео, а також на фізично точну передачу швидких рухів.

Захист авторських прав та ринкові позиції

Meta впровадила в Muse Image систему невидимих водяних знаків Content Seal. За твердженням компанії, мітка зберігається навіть після кадрування, стиснення, зміни розміру або створення скріншоту. У майбутньому планується поширити цей захист і на відео.

Згідно з метриками Arena, Muse Image посідає друге місце в категоріях text-to-image, single-image editing та multi-image editing, поступаючись лише GPT Image 2. Це підтверджує серйозну конкурентоспроможність рішення Meta на ринку генеративних ШІ.

Експертна думка Cryptalist: Запуск Muse Image та анонс Muse Video — це не просто чергові оновлення, а стратегічний крок Meta із захоплення частки ринку в сегменті креативних ШІ-інструментів. Особливий інтерес викликає агентна архітектура Muse Image, яка може стати фундаментом для майбутніх автономних ШІ-асистентів. Однак ключовий виклик — це доведення Muse Video до конкурентоспроможного рівня, особливо у сфері фізичної симуляції руху, де моделі від OpenAI та Runway поки зберігають перевагу.