Американски съдии тепърва решават дали AI моделите четат чуждите книги, или ги преписват - а от отговора зависи цяла индустрия.
Fair use не е дупка в закона - вграден предпазен клапан е. Съдия преценява по четири критерия: с каква цел се ползва чуждото произведение, какъв е характерът му, колко от него е взето и дали новото нещо съсипва пазара на оригинала. Ако резултатът е достатъчно "трансформативен" - прави нещо ново, не просто продава копие - съдът може да прецени, че няма кражба, дори без разрешение на автора.
AI компаниите поставят точно този въпрос в основата на защитата си. За да "научи" даден модел как звучи човешки текст или как изглежда снимка, той трябва да мине през огромен обем чужди книги, статии, музика, изображения. Тезата на компаниите е проста: моделът не съхранява и не препродава оригинала - само учи от него, както човек чете стотици книги и после пише собствена. Опонентите виждат друго: това не е четене, това е смилане на цели библиотеки, за да произведеш продукт, който после конкурира и измества самите автори, от чийто труд си се възползвал без стотинка.
Първото сериозно съдебно решение по темата дойде срещу Anthropic - компанията зад чатбота Клод, основана от бивши инженери на OpenAI. Съдията реши нещо разделено на две: обучението на модела върху легално закупени книги е честна употреба, защото е трансформативно. Но начинът, по който компанията си е набавила част от книгите - свалени милиони пиратски копия от нелегални библиотеки в мрежата - не е честна употреба, а най-обикновена кражба. Резултатът: сетълмент от 1,5 милиарда долара, платими на авторите на засегнатите книги, около 3000 долара на заглавие.
Делото на New York Times - американски вестник - срещу OpenAI, компанията зад ChatGPT, все още тече и е много по-мрачно за индустрията. Вестникът твърди, че OpenAI укрива доказателства, и настоява съдът да наложи санкции. Спорът е дали чатботът е бил само обучаван с тези статии, или понякога е възпроизвеждал буквално цели пасажи от тях - а това е много по-трудно за защита пред съда от просто "учене от стил". Делото още няма присъда, и точно то може да стане прецедент за цялата индустрия.
Успоредно тече и дело срещу Meta, компанията майка на Facebook и Instagram. Съдът вече отхвърли частично претенциите на авторите на база честна употреба за самото обучение на модела, но остави отворени обвиненията за пиратско сваляне на книгите. Картината, която се очертава от всички тези дела, е една и съща: учене от чуждо съдържание е позволено. Начинът, по който компаниите са си го набавили, е отделен, много по-опасен въпрос.