The New York Times и The Daily News обвиняют OpenAI во лжи о возможностях поиска по логам чатов и обучающим данным. Это новый виток двухлетнего судебного дела о нарушении авторских прав.
OpenAI утверждала, что не может искать по собственному корпусу обучающих данных и что обработка логов ChatGPT технически сложна и нарушает приватность пользователей.
Однако на апрельском допросе инженер OpenAI Винни Монако якобы раскрыл: компания уже проводила внутренние поиски по корпусу на предмет нарушения авторских прав журналистов.
Также выяснилось: ещё до подачи иска OpenAI собрала базу из ~78 млн деанонимизированных диалогов ChatGPT для оценки масштабов нарушений. После подачи иска запустили «Project Giraffe» с фильтром Bloom для отслеживания воспроизведения чужих текстов.
Истцы запрашивали 120 млн логов, OpenAI сократила выборку до 20 млн — и та оказалась настолько заретуширована, что суд счёл её «непригодной». Также компанию обвиняют в удалении миллиардов выводов ChatGPT вопреки судебному предписанию.
«Если бы OpenAI считала копирование журналистики законным, она бы не скрывала факт этого», — заявил адвокат истцов Йен Кросби.
Истцы просят суд наказать OpenAI: исключить выборку логов как доказательство, признать факт воспроизведения контента и взыскать судебные расходы.
Представитель OpenAI Дрю Пусатери отверг обвинения, заявив, что Times пытается получить доступ к переписке пользователей на фоне слабеющей позиции в суде.

0 комментариев