Meta өзінің жаңа флагмандық сурет генерациялау моделін — Muse Image ресми түрде таныстырды, сондай-ақ алғаш рет Muse Video бейнегенераторының ерте нұсқасын көрсетті. Екі шешім де Meta Superintelligence Labs бөлімшесімен әзірленген және жасанды интеллект көмегімен контент жасау саласындағы маңызды қадам болып табылады.

Muse Image қазірдің өзінде АҚШ пайдаланушыларына Meta AI қосымшасы, meta.ai веб-нұсқасы, Instagram Stories және ішінара WhatsApp арқылы қолжетімді. Компанияның мәлімдеуінше, бұл бүгінгі күндегі сурет генерациялаудың ең озық моделі. Негізгі айырмашылығы — промпттарды дәл орындау, жасалған суреттерді өңдеу мүмкіндігі және бірнеше референстен көрініс құрастыру. Instagram-ның әлеуметтік контекстімен интеграцияға ерекше назар аударылған, бұл модельге неғұрлым өзекті және жекелендірілген контент генерациялауға мүмкіндік береді.

Muse Image архитектурасы агенттік модель принципі бойынша құрылған: ол интернеттен өз бетінше іздеу жүргізуге, код жазу және орындау құралдарын пайдалануға, сондай-ақ генерация процесінде суретті жетілдіруге қабілетті. Бұл оны жай генератор емес, шығармашылық тапсырмалар үшін толыққанды көмекшіге айналдырады.

Сонымен қатар, Muse Image басқа модельмен — Muse Spark біріктірілген. Осы екі ЖИ-дің байланысы анимациялық GIF, кірістірілген суреттері бар толыққанды веб-сайттар, тіпті интерактивті визуалды ойындар жасауға мүмкіндік береді, медиагенерацияны да, код жазуын да қамтиды.

Muse Video: болашақтың алдын ала көрінісі

Сонымен қатар Meta Muse Video-ның ерте алдын ала көрінісін көрсетті. Модель Muse Image сияқты алдын ала оқытылған базада құрылған, бұл жоғары визуалды сапа мен аудионың табиғи қолдауын қамтамасыз етеді. Компания соңғы нұсқа әлі әзірлену үстінде екенін мойындайды: негізгі күш қазір аудио мен бейнені синхрондауға, сондай-ақ жылдам қозғалыстарды физикалық тұрғыдан дәл жеткізуге бағытталған.

Авторлық құқықтарды қорғау және нарықтағы позициялар

Meta Muse Image-ге көрінбейтін су таңбалары жүйесін Content Seal енгізді. Компанияның мәлімдеуінше, белгі кадрлау, қысу, өлшемін өзгерту немесе скриншот жасаудан кейін де сақталады. Болашақта бұл қорғауды бейнеге де тарату жоспарлануда.

Arena метрикалары бойынша, Muse Image text-to-image, single-image editing және multi-image editing санаттарында екінші орынды алады, тек GPT Image 2-ден ғана қалып отыр. Бұл Meta шешімінің генеративті ЖИ нарығындағы бәсекеге қабілеттілігін растайды.

Cryptalist сарапшысының пікірі: Muse Image іске қосылуы және Muse Video жариялануы — бұл жай кезекті жаңартулар емес, Meta-ның креативті ЖИ-құралдар сегментінде нарық үлесін иемденуге бағытталған стратегиялық қадамы. Muse Image-нің агенттік архитектурасы ерекше қызығушылық тудырады, ол болашақ автономды ЖИ-көмекшілерінің негізі бола алады. Алайда негізгі сын — Muse Video-ны бәсекеге қабілетті деңгейге жеткізу, әсіресе қозғалыстың физикалық симуляциясы саласында, мұнда OpenAI және Runway модельдері әлі де артықшылығын сақтап отыр.