xAI добави референции към видео модела Imagine Video 1.5: пращаш снимка на герой и запис на глас, и моделът ги пази еднакви от сцена в сцена. Идват и видео само от текст, и родна резолюция 1080p. Референциите тръгват първо в САЩ, за платените нива.
- Референции: моделът получава изображение на героя и гласов запис и пази и лицето, и гласа консистентни между сцените.
- Видео само от текстово описание и родна 1080p са общодостъпни на grok.com/imagine, iOS и Android; референциите тръгват в САЩ за SuperGrok Heavy и Plus.
- Всичко е достъпно и през API.
Пращаш снимка на героя. Пращаш запис на гласа. Десет кадъра по-късно е същият човек, със същия глас - точно тук досега се чупеше AI видеото.
Защо постоянството е същината. Ефектен кадър AI видеото прави отдавна. Реклама, поредица, обяснително видео - това са десет, двайсет, трийсет кадъра с един и същ герой. Тъкмо там досега AI видеото се разпадаше: лицето плуваше, гласът се сменяше, зрителят усещаше шева. Референцията превръща модела от генератор на ефекти в нещо като актьор с договор - извикваш го утре, и той е същият.
Границата пак се мести. Снимачен ден за прост рекламен клип вече се конкурира с един следобед пред екрана. Но окото решава кое става за пред клиента - постоянството го дава инструментът, вкусът - не.