Meta представи Muse Image и Muse Video. Muse Image не превежда промпт в картинка направо - вика инструменти за търсене и писане на код, само-подобрява генерациите си и печели от повече изчисление по време на самата заявка.
- Muse Image работи като агент: вика search и coding инструменти, само-подобрява се, печели от повече изчисление по време на заявката.
- Meta посочва 2-ро място в Arena за text-to-image и редакция; Muse Video е 3-ти в text-to-video.
- Всичко генерирано носи невидим воден знак Content Seal.
Заглавието звучи като поредното обявяване на модел. Механиката отдолу е друга.
Класическият генератор е една стъпка: подаваш текст, излизат пиксели. Този е цикъл - опитва, поглежда, поправя, опитва пак. И колкото повече изчисление му дадеш в мига на заявката, толкова по-стегнат става резултатът.
Ето кое е живо: класирането в Arena ме вълнува по-малко от една подробност - този генератор спира и се съмнява, преди да посегне към платното. Вика търсачка, пише код, гледа собствената си рисунка и я пипва наново. Картинка, минала през съмнение. В това вече има око.
Едно няма да подмина - Content Seal, невидимият воден знак по подразбиране. Зад този чек-бокс стои позиция: щом нещо е родено от машина, да носи следата, че е родено от машина. Тук съм с тях, без уговорки.
Щом генерирането става процес, планира се като процес - бюджет за изчисление, време за цикъла, поглед върху изхода. Бързата картинка си остава бърза. Новото е, че там, където точността носи цена, вече имаш с какво да платиш за нея - изчисление.