Разработчикът на генеративен изкуствен интелект Anthropic ще изплати 1,5 млрд. долара по колективен иск за нарушаване на авторски права, съобщава Ройтерс.
Федерален съд в САЩ одобри окончателното споразумение между компанията и група автори на книги, чиито пиратски копия са използвани за тренирането на модела ѝ Claude и съхранявани в специална библиотека.
Това е най-голямото известно извънсъдебно споразумение по подобно дело, отбелязва информационната агенция. Случаят се разглежда и като важен прецедент, който може да повлияе върху начина, по който цялата AI индустрия използва защитено съдържание за обучение на езикови модели.
Защо решението е толкова важно
Макар размерът на компенсацията да привлича вниманието, по-съществено за технологичния сектор е правното разграничение, което съдът прави между различните начини за използване на защитени произведения.
Съдът приема, че обучението на езиков модел с книги при определени условия може да попадне в обхвата на принципа за "добросъвестно използване" (fair use) съгласно американското законодателство. В същото време обаче съдията постановява, че съхраняването на милиони пиратски копия в централизирана библиотека представлява нарушение на авторските права.
Именно тази констатация е в основата на рекордното финансово споразумение.
Последици за разработчиците на AI
Случаят е внимателно следен от цялата индустрия, тъй като срещу редица разработчици на генеративен изкуствен интелект вече се водят сходни дела.
През последните две години автори, медийни компании, музикални издатели и други притежатели на права заведоха искове срещу технологични компании с аргумента, че техни произведения са били използвани за обучение на AI модели без лиценз или разрешение.
Решението по делото срещу Anthropic очертава възможна посока, по която американските съдилища могат да разглеждат подобни казуси занапред.
Повече лицензирано съдържание вместо свободно събиране на данни
Юристи и анализатори очакват решението да ускори тенденцията големите AI компании да сключват лицензионни споразумения с издатели, медийни организации и собственици на съдържание.
През последната година OpenAI, Google, Microsoft, Amazon, Meta и други компании подписаха редица договори с международни издатели и информационни агенции за използване на съдържание при разработването на нови поколения AI модели.
Този подход позволява достъп до висококачествени данни, като едновременно намалява правните рискове и вероятността от бъдещи съдебни спорове.
AI инвестициите ще трябва да включват и разходи за съдържание
Случаят показва и промяната в икономическия модел на генеративния изкуствен интелект.
Досега основният фокус на компаниите беше върху изчислителната мощност, специализираните чипове и центровете за данни. Все по-ясно обаче става, че достъпът до легално лицензирани масиви от текстове, изображения, видео и други данни се превръща в стратегически актив, който е от съществено значение за развитието на AI платформите.
Това означава, че разходите за лицензиране на съдържание вероятно ще се превърнат в постоянен елемент от инвестициите в изкуствен интелект.
Спорът далеч не е приключил
Въпреки рекордното споразумение съдебните битки около обучението на генеративен AI продължават.
Срещу Anthropic има и други производства извън настоящия колективен иск, а подобни дела се водят и срещу OpenAI, Meta и други компании.
Затова решението на съда се разглежда не като край на спора, а като една от първите ясни индикации къде могат да бъдат поставени границите между допустимото използване на защитено съдържание за обучение на изкуствен интелект и нарушенията на авторските права.
За бизнеса това означава, че въпросите, свързани с произхода на данните, лицензирането на съдържание и управлението на интелектуалната собственост, ще се превръщат във все по-важна част от стратегията за разработване и внедряване на AI решения.