Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте

Новости

NYT обвинила OpenAI в сокрытии данных по копирайту

The New York Times и Daily News обвиняют OpenAI в сокрытии доказательств по делу о нарушении копирайта. Показания сотрудников компании выявили, что у неё были инструменты поиска защищённого контента и база из 78 млн диалогов ChatGPT, а также внутренний мониторинг нарушений. Истцы просят суд применить санкции и исключить часть доказательств, предоставленных OpenAI.

9 июля 2026 г.
4 мин
30

The New York Times и Daily News утверждают, что OpenAI вводила суд в заблуждение относительно своей способности искать в пользовательских логах и обучающих датасетах защищённый копирайтом контент. Это очередной виток двухлетнего иска против AI-компании, где её обвиняют в нарушении авторских прав при обучении генеративных моделей на материалах Times и последующем воспроизведении этих материалов в ответах.

На протяжении всего процесса OpenAI настаивала, что у неё нет технической возможности провести поиск по собственному обучающему корпусу. Также компания утверждала, что извлечение и обработка огромного массива диалогов с ChatGPT будут чрезмерно сложны и поставят под угрозу приватность пользователей. Истцы же добивались этих данных, чтобы понять, присутствовали ли их статьи в обучающей выборке и насколько часто ChatGPT генерировал ответы с использованием их контента.

В ходе дачи показаний по решению суда в апреле инженер OpenAI по защите данных Винни Монако, как утверждается, признал, что компания уже проводила внутренний поиск и анализ обучающих данных на предмет наличия защищённых журналистских материалов.

Эти же показания якобы вскрыли, что ещё до подачи иска NYT OpenAI собрала базу примерно из 78 миллионов деперсонализированных диалогов ChatGPT и использовала её для внутренней оценки масштабов нарушения чужих прав. Кроме того, вскоре после начала судебного разбирательства компания внедрила так называемый фильтр «Bloom» в составе инструментов «Project Giraffe», который выявлял и протоколировал случаи дословного воспроизведения материалов в ответах.

Последние два открытия особенно важны. Изначально истцы запрашивали выборку из 120 миллионов логов, но OpenAI договорилась сократить её до 20 миллионов. В декабре прошлого года компания всё же передала эту сокращённую выборку, но, как утверждается, с таким количеством цензурных изъятий, что суд назвал её «непригодной для использования». Ранее истцы также заявляли, что OpenAI удалила миллиарды ответов ChatGPT уже после подачи иска, прямо нарушив предписание суда сохранить доказательства, и что компания подменила миллионы логов в запрошенной выборке.

Иными словами, по мнению заявителей, OpenAI намеренно усложнила получение информации, которая у неё уже имелась.

«Если бы OpenAI искренне считала копирование журналистских материалов наших клиентов добросовестным и законным, она не стала бы скрывать правду о том, что делала это», — заявил Иэн Б. Кросби, главный юрист истцов.

Теперь NYT и Daily News просят суд применить к OpenAI санкции за якобы имевшее место сокрытие доказательств и вмешательство в процесс их раскрытия. Они требуют запретить компании использовать выборку из 20 миллионов логов как доказательство, считая её ненадёжной; признать установленным фактом, что логи ChatGPT продемонстрировали бы масштабные случаи воспроизведения и опоры на контент истцов; запретить OpenAI утверждать, что предоставленные логи не показывают существенного воспроизведения; и обязать компанию оплатить судебные издержки, вызванные необходимостью выбивать эти доказательства.

Представитель OpenAI Дрю Пусатери в официальном заявлении отверг обвинения, упрекнув Times в попытках получить доступ к частным разговорам пользователей по мере ослабления её позиций.

«Пока дело Times разваливается и они вынуждены отзывать претензии, истцы продолжают посягать на приватность людей, не имеющих к процессу никакого отношения, в том числе выдвигая эти откровенно ложные обвинения», — сказал Пусатери. — «Мы продолжим защищать приватность пользователей и устоявшиеся принципы добросовестного использования».