Сегодня 30 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

New York Times обвинила OpenAI в сокрытии улик по делу об обучении ИИ на чужих материалах

Утверждения OpenAI о том, что разработчик ChatGPT не имеет возможности производить поиск по перепискам пользователей и чат-бота с искусственным интеллектом, а также по массивам обучающих данных, не соответствуют действительности, заявили представители газет New York Times и The Daily News.

 Источник изображений: Mariia Shalabaieva / unsplash.com

Источник изображений: Mariia Shalabaieva / unsplash.com

Издания уже два года судятся с разработчиком систем ИИ, утверждая, что компания нарушила авторское право, обучая свои генеративные ИИ-модели на их материалах, которые воспроизводятся дословно в ответах на запросы пользователей. Всё это время OpenAI утверждает, что у неё нет возможности искать информацию в обучающем массиве. Она также настаивает, что поиск или воспроизведение переписки пользователей с ChatGPT были бы технически обременительными и вызвали бы опасения по поводу конфиденциальности пользователей — журналы чатов пришлось бы извлекать, обрабатывать и обезличивать. Издания запрашивали эти сведения, чтобы определить, присутствуют ли их защищённые авторским правом публикации в обучающих массивах OpenAI, и генерирует ли ChatGPT ответы, используя и воспроизводя их контент.

В ходе допроса, проведённого в апреле по решению суда, инженер по защите данных в OpenAI Винни Монако (Vinnie Monaco) якобы сообщил, что компания всё-таки производила поиск и оценку данных в обучающем массиве, чтобы выявить присутствие защищённых авторским правом журналистских работ. По его словам, ещё до подачи New York Times иска OpenAI уже собрала базу из 78 млн обезличенных переписок с ChatGPT, которую использовала, чтобы определить степень нарушения авторских прав на чужие работы. После подачи иска компания также предположительно внедрила фильтр Bloom в наборе средств Project Giraffe, который фиксировал повторения во выходных данных.

Первоначально истцы запрашивали выборку из 120 млн журналов переписки, но OpenAI договорилась сократить её объем до 20 млн. В декабре компания представила эти данные, но они, как определил суд, были настолько вымараны, что стали «непригодными для использования». После подачи иска OpenAI, утверждают истцы, удалила несколько миллиардов ответов ChatGPT, нарушив тем самым постановление суда о сохранении данных; а несколько миллионов журналов компания просто заменила. Другими словами, она неоправданно затруднила передачу уже собранной информации.

«Если бы OpenAI действительно считала, что копировать журналистские материалы наших клиентов — это честно и по закону, она бы не скрывала правду, что сделала это», — заявил адвокат истцов. New York Times и The Daily News просят судью вынести OpenAI наказание за сокрытие доказательств и вмешательство в процесс раскрытия информации. Они ходатайствуют, чтобы OpenAI запретили использовать массив из 20 млн журналов чатов как доказательство, утверждая, что этот набор данных ненадёжен; чтобы суд принял как факт, что журналы переписок ChatGPT показали бы существенное повторение материалов истцов; чтобы OpenAI лишилась возможности утверждать что в представленных ей журналах переписок не демонстрируется существенное повторение материалов; и чтобы OpenAI оплатила судебные издержки за поиск этих доказательств.

Представитель OpenAI отверг обвинения, обвинив истцов в попытке получить доступ к частной переписке пользователей, потому что позиция истцов ослабла. «По мере ослабления позиции Times и вынужденного отказа от претензий к нам они продолжают свои попытки вторгнуться в частную жизнь людей, не имеющих к этому делу никакого отношения, в том числе путём выдвижения этих заведомо ложных обвинений. Мы и далее будем защищать конфиденциальность наших пользователей и давно установленные принципы добросовестного использования», — подчеркнул он.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Идеальное сочетание Elden Ring и Arc Raiders, но худший босс — очередь на сервер»: релиз экшена Mistfall Hunter был омрачён техническими проблемами 26 мин.
Разработчики Path of Exile 2 наконец устранили зависания, которые мучили игроков с самого релиза — виновата была Nvidia 29 мин.
Павла Дурова включили в список экстремистов и террористов Росфинмониторинга 3 ч.
OpenAI подарит 100 000 учёным бесплатный доступ к своим ИИ-моделям 3 ч.
Европа заставит помечать весь ИИ-контент — новые правила вступают в силу уже в воскресенье 3 ч.
GPT-5.6 и ChatGPT Work разогнали выручку OpenAI — компания догоняет Anthropic 4 ч.
Альтернативные мессенджеры BiP и KakaoTalk засбоили в России 4 ч.
Стильный ролевой боевик Stupid Never Dies о самом слабом зомби в мире расскажет безумную историю любви — новый трейлер и дата выхода 5 ч.
Yandex B2B Tech выпустит универсального ИИ-агента — он сможет автоматизировать до половины бизнес-задач 5 ч.
Microsoft подтвердила подготовку «суперприложения» Copilot — оно выйдет уже в этом году 5 ч.
Астрономы получили самое чёткое изображение неуловимой звезды-компаньона Бетельгейзе 2 ч.
Продажи мобильных процессоров MediaTek и Qualcomm упали, а Samsung и Google — выросли 2 ч.
Карманная «киношная» камера DJI Osmo Pocket 4P с подвесом и двумя объективами поступила в продажу 2 ч.
Kioxia представила свои первые SSD с PCIe 6.0 — до 61,44 Тбайт, но скорость пока не уточняется 2 ч.
Мобильное подразделение Samsung впервые в истории закончило квартал с убытком — виноват дефицит памяти 5 ч.
Sony захотела купить производителя объективов Tamron 5 ч.
MSI анонсировала серверы на базе AMD EPYC Venice 9006 с воздушным и жидкостным охлаждением 5 ч.
Грядёт подорожание смартфонов: Qualcomm объявила о повышении цен на все свои чипы с 1 сентября 5 ч.
AAEON представила Mini-ITX-плату MIX-Q870A1 с процессором Intel Core Ultra 200S 5 ч.
Samsung прогнозирует усугубление дефицита чипов в 2027 году и его сохранение в 2028-м 6 ч.