Сегодня 19 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

New York Times обвинила OpenAI в сокрытии улик по делу об обучении ИИ на чужих материалах

Утверждения OpenAI о том, что разработчик ChatGPT не имеет возможности производить поиск по перепискам пользователей и чат-бота с искусственным интеллектом, а также по массивам обучающих данных, не соответствуют действительности, заявили представители газет New York Times и The Daily News.

 Источник изображений: Mariia Shalabaieva / unsplash.com

Источник изображений: Mariia Shalabaieva / unsplash.com

Издания уже два года судятся с разработчиком систем ИИ, утверждая, что компания нарушила авторское право, обучая свои генеративные ИИ-модели на их материалах, которые воспроизводятся дословно в ответах на запросы пользователей. Всё это время OpenAI утверждает, что у неё нет возможности искать информацию в обучающем массиве. Она также настаивает, что поиск или воспроизведение переписки пользователей с ChatGPT были бы технически обременительными и вызвали бы опасения по поводу конфиденциальности пользователей — журналы чатов пришлось бы извлекать, обрабатывать и обезличивать. Издания запрашивали эти сведения, чтобы определить, присутствуют ли их защищённые авторским правом публикации в обучающих массивах OpenAI, и генерирует ли ChatGPT ответы, используя и воспроизводя их контент.

В ходе допроса, проведённого в апреле по решению суда, инженер по защите данных в OpenAI Винни Монако (Vinnie Monaco) якобы сообщил, что компания всё-таки производила поиск и оценку данных в обучающем массиве, чтобы выявить присутствие защищённых авторским правом журналистских работ. По его словам, ещё до подачи New York Times иска OpenAI уже собрала базу из 78 млн обезличенных переписок с ChatGPT, которую использовала, чтобы определить степень нарушения авторских прав на чужие работы. После подачи иска компания также предположительно внедрила фильтр Bloom в наборе средств Project Giraffe, который фиксировал повторения во выходных данных.

Первоначально истцы запрашивали выборку из 120 млн журналов переписки, но OpenAI договорилась сократить её объем до 20 млн. В декабре компания представила эти данные, но они, как определил суд, были настолько вымараны, что стали «непригодными для использования». После подачи иска OpenAI, утверждают истцы, удалила несколько миллиардов ответов ChatGPT, нарушив тем самым постановление суда о сохранении данных; а несколько миллионов журналов компания просто заменила. Другими словами, она неоправданно затруднила передачу уже собранной информации.

«Если бы OpenAI действительно считала, что копировать журналистские материалы наших клиентов — это честно и по закону, она бы не скрывала правду, что сделала это», — заявил адвокат истцов. New York Times и The Daily News просят судью вынести OpenAI наказание за сокрытие доказательств и вмешательство в процесс раскрытия информации. Они ходатайствуют, чтобы OpenAI запретили использовать массив из 20 млн журналов чатов как доказательство, утверждая, что этот набор данных ненадёжен; чтобы суд принял как факт, что журналы переписок ChatGPT показали бы существенное повторение материалов истцов; чтобы OpenAI лишилась возможности утверждать что в представленных ей журналах переписок не демонстрируется существенное повторение материалов; и чтобы OpenAI оплатила судебные издержки за поиск этих доказательств.

Представитель OpenAI отверг обвинения, обвинив истцов в попытке получить доступ к частной переписке пользователей, потому что позиция истцов ослабла. «По мере ослабления позиции Times и вынужденного отказа от претензий к нам они продолжают свои попытки вторгнуться в частную жизнь людей, не имеющих к этому делу никакого отношения, в том числе путём выдвижения этих заведомо ложных обвинений. Мы и далее будем защищать конфиденциальность наших пользователей и давно установленные принципы добросовестного использования», — подчеркнул он.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Xiaomi раскрыла список устройств, которые получат аналог «Жидкого стекла» в HyperOS 4 16 мин.
Windows 11 научится блокировать камеру и микрофон для каждого приложения 25 мин.
Американские законодатели подсели на ChatGPT — и завалили юристов работой 29 мин.
Вторая за сутки утечка GTA VI показала ночной геймплей и раскрыла новые подробности игры 42 мин.
Sony перезапустила разработку Horizon Hunters Gathering на фоне критики игроков, а Horizon 3 придётся ждать «годы» 2 ч.
Telegram дважды оштрафовали в России — с начала года сумма штрафов перевалила за 100 млн рублей 2 ч.
У ИИ-клавиатуры Gboard Rambler в смартфонах Pixel 11 нашлись лимиты — но и без облака она функциональна 2 ч.
Кибербезопасность пожертвований: как защитить данные доноров от хакеров 3 ч.
Стоимость развёртывания ведущих мировых ИИ-моделей в России за год выросла в 2,8 раза 4 ч.
Грандиозная космическая опера Exodus в духе Mass Effect заинтересовала более полумиллиона игроков — разработчики подготовили награды 5 ч.
Samsung Galaxy S26 FE получит повышенную автономность — ценой долговечности аккумулятора 22 мин.
Человеческие нейроны подружились с кремнием: в Сингапуре запустили прототип «биологического» ЦОД 40 мин.
Amazon организует доставку дронами в 500 городах и населённых пунктах США 49 мин.
Sony до сих пор не определилась со сроками выхода PlayStation 6 2 ч.
Жители Мэна «потопили» проект подводного ИИ ЦОД DeepGreen 2 ч.
Людей научились распознавать по обычному Wi-Fi — почти 100-% точность без камер и специальных датчиков 2 ч.
Разработчик инференс-чипов Etched привлёк ещё $700 млн, доведя оценку капитализации до $21 млрд 3 ч.
Seasonic готовит первый потребительский блок питания с сертификатом 80 Plus Ruby — он даст КПД от 85 до 95 % 3 ч.
Google раскрыла, когда проведёт официальную презентацию Googlebook 3 ч.
Представлен 3D-принтер для атомарной печати невозможных в природе материалов — к нему уже прикрутили ИИ и дали свободу творить 3 ч.