Спор об авторских правах вокруг ChatGPT превратился в спор о том, что OpenAI сообщала суду. В четверг, 9 июля, коалиция из шести новостных организаций попросила федерального судью на Манхэттене наложить санкции на OpenAI за то, что они называют нарушениями в ходе раскрытия доказательств: компания утверждала, что технически не может искать в своих обучающих данных и чат-логах журналистские материалы, защищенные авторским правом, хотя внутри компании это уже было сделано.
Кто подал ходатайство
Ходатайство, поданное в Южном округе Нью-Йорка, исходит от The New York Times, New York Daily News и более чем дюжины других новостных организаций, среди них Chicago Tribune и другие издания Tribune Publishing и MediaNews Group, Santa Rosa Press Democrat, Ziff Davis, The Intercept и Center for Investigative Reporting. Основное дело, поданное Times 27 декабря 2023 года против OpenAI и соответчика Microsoft, находится у судьи Sidney H. Stein и в апреле 2025 года пережило ходатайство об отклонении.
Показания под присягой
Ключевую роль играет Vinnie Monaco, руководитель направления конфиденциальности и инженерии OpenAI, которого в апреле допросили в качестве корпоративного свидетеля после того, как мировой судья обязал его вернуться на дополнительные три с половиной часа, сочтя его неготовым к первой сессии. Истцы утверждают, что Monaco подтвердил: OpenAI проводила внутренний поиск по своему обучающему корпусу и выходам модели специально в отношении журналистских материалов, защищенных авторским правом, а также создала базу данных примерно из 78 миллионов обезличенных разговоров ChatGPT — работа над которой началась до того, как первый истец из числа СМИ подал иск. Отдельно они описывают инструмент для выявления регургитации — фильтр "Bloom", созданный в рамках проекта под названием Giraffe вскоре после подачи иска.
Что они требуют
Помимо санкций, издатели просят суд отклонить предоставленную OpenAI выборку из 20 миллионов чат-логов как ненадежную замену полного массива данных. В публикациях о ходатайстве указывается, что заявленные меры включают денежные штрафы, специальные указания для присяжных и другие меры. Они утверждают, что OpenAI удалила или сделала недоступными для поиска миллиарды релевантных разговоров, некоторые — уже после судебного распоряжения о сохранении данных. "Если бы OpenAI действительно считала, что копирование журналистских материалов наших клиентов было добросовестным и законным, она бы не скрывала правду о том, что это делала", — заявил адвокат истцов Ian B. Crosby. Соруководитель защиты Steven Lieberman высказался еще прямее: ходатайство "просит суд наказать OpenAI за сокрытие и уничтожение доказательств того, как ChatGPT обучали на украденной журналистике".
Ответ OpenAI
Представитель компании Drew Pusateri сказал: "По мере того как дело Times слабеет и их вынуждают отказываться от претензий к нам, они продолжают попытки вторгнуться в частную жизнь людей, которые не имеют никакого отношения к этому делу, в том числе выдвигая эти откровенно ложные обвинения". Судья Stein пока не вынес решения.
