Sonata

Как суды решают спор между авторским правом и обучением ИИ

image source

Крупные ИИ-модели вроде ChatGPT, Gemini и Claude обучаются на гигантских массивах данных — книгах, статьях, научных работах и практически всём, что можно найти в интернете. Большинство авторов даже не подозревали, что их труды стали частью обучающих датасетов для технологий, которые теперь угрожают их профессии. Казалось бы, это должно быть незаконно, но всё гораздо сложнее.

«Это очень сложная область, где сталкиваются сильные эмоции — как за, так и против», — отмечает Кэти Геллис, юрист по интеллектуальной собственности и технологиям.

В прошлом году судья Уильям Алсап обязал Anthropic выплатить $1,5 млрд писателям за использование их произведений при обучении ИИ. На первый взгляд это выглядело победой авторов, но на деле судья признал само обучение моделей законным. Штраф был назначен именно за пиратское скачивание книг с нелегальных ресурсов.

Судья сравнил процесс обучения языковой модели с чтением литературы начинающим писателем — модель учится не копировать, а создавать нечто новое. Геллис считает, что решение скорее выгодно ИИ-компаниям: $1,5 млрд — незначительная сумма для бизнеса, который к 2028 году может приносить около $200 млрд годового дохода.

«Авторское право строится вокруг копирования, а не вокруг использования или прочтения произведения», — поясняет Геллис.

Закон об авторском праве не обновлялся с 1976 года, поэтому судьям приходится применять полувековые нормы к вопросам, которые определят будущее ИИ-индустрии.

«Все сейчас очень обеспокоены, потому что законодательство разрознено — модели обучены на огромных массивах данных, а закон просто не успевает за этим», — говорит Джейсон Хендерсон, старший юрист и основатель практики интеллектуальной собственности JWL International.

Ключевой вопрос — является ли использование материалов «трансформативным» настолько, чтобы подпадать под доктрину добросовестного использования (fair use). Эта норма позволяет использовать защищённый контент без разрешения — для критики, пародии, обучения и других целей.

Суды учитывают цель и характер использования, объём заимствованного материала и влияние на рынок оригинала. По словам Хендерсона, если ИИ-продукт создаётся для прямой конкуренции с источником данных, суды относятся к этому негативно; если нет — шансы на признание fair use выше.

Показательный пример — дело Thomson Reuters против Ross Intelligence, которая копировала контент компании для создания конкурирующей юридической платформы на основе ИИ. Судья Стефанос Бибас постановил, что такое использование не является трансформативным, поскольку не имеет иной цели, кроме конкуренции.

Авторы книг теоретически могут утверждать, что чат-боты конкурируют с ними, генерируя новые синтетические произведения, но подобный аргумент пока не побеждал в суде.

Геллис отмечает, что важно разделять два разных вопроса: обучение ИИ на чужих текстах и авторские права на контент, созданный самим ИИ. В деле Thaler v. Perlmutter суд постановил, что полностью сгенерированные ИИ произведения не подлежат защите авторским правом.

Это порождает новые сложности: как доказать, что работа создана ИИ, и какую долю участия человека считать достаточной для защиты. «Если вы пишете роман в Word и используете проверку орфографии, мы же не считаем, что Word владеет вашим романом», — говорит Геллис.

Большинство ИИ-компаний остаются участниками судебных разбирательств, поэтому окончательного решения этих вопросов ждать пока рано. Как отмечает Геллис, первые судебные решения уже формируют практику, хотя более поздние инстанции могут их пересмотреть — и игнорировать эти прецеденты ИИ-компаниям было бы неразумно.

источник

Загрузка страницы