Сегодня 06 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → the new york times

The New York Times обвинила ИИ-стартап Perplexity в создании «дословных копий» своих статей

Издательство The New York Times (NYT) подало судебный иск на «систему ответов» ИИ-стартапа Perplexity. NYT утверждает, что Perplexity «незаконно сканирует, копирует, извлекает и распространяет» материалы с сайта издательства. По словам истца, ответы, предоставляемые ИИ-поисковиком Perplexity являются «дословными или существенно похожими копиями» материалов NYT, защищённых авторским правом.

 Источник изображения: unsplash.com

Источник изображения: unsplash.com

«Копируя защищённый авторским правом контент The Times и создавая на его основе замещающую продукцию, устраняя необходимость посещения веб-сайта The Times или покупки газеты, Perplexity незаконно присваивает себе значительные возможности получения дохода от подписки, рекламы, лицензирования и партнёрских программ, которые по праву принадлежат исключительно The Times», — говорится в иске NYT.

Иск был подан после неоднократных требований в адрес Perplexity о прекращении использования контента с сайта NYT. Такие уведомления направлялись неоднократно в течение последних двух лет, но были проигнорированы. NYT требует возмещения ущерба и просит суд навсегда запретить Perplexity заниматься подобной деятельностью. Газета Chicago Tribune также подала в четверг иск о нарушении авторских прав против Perplexity.

Perplexity стала объектом нескольких судебных исков после того, как Forbes и Wired обвинили стартап в обходе платного доступа к их сайтам и использования их контента. NYT выдвигает аналогичные обвинения в своём иске, заявляя, что роботы Perplexity «намеренно игнорировали или обходили технические меры защиты контента», такие как файл robots.txt, который прямо указывает на разделы сайта, которые боты не должны сканировать и индексировать.

В июне британская корпорация BBC (Би-би-си) пригрозила иском Perplexity, заявив, что «базовая модель искусственного интеллекта» американского стартапа «была обучена с использованием контента BBC». Для телекомпании это стало первой попыткой пресечь деятельность технологических стартапов, использующих огромные запасы контента BBC для обучения нейросетей.

В августе компания Cloudflare обвинила стартап Perplexity в массовом скрапинге веб-сайтов, которые явным образом запрещают сбор данных. Согласно исследованию Cloudflare, опубликованному 4 августа, боты Perplexity игнорировали технические ограничения, установленные в файле robots.txt, и продолжали извлекать и копировать контент с десятков тысяч доменов, создавая миллионы запросов ежедневно.

В сентябре «Британская энциклопедия» (Encyclopedia Britannica) и её дочерняя компания Merriam-Webster подали иск в федеральный суд Нью-Йорка против компании Perplexity AI, обвинив её в нарушении авторских прав и товарных знаков. В иске обе компании утверждают, что система ответов Perplexity копирует их сайты, крадёт интернет-трафик и занимается плагиатом их материалов, защищённых авторским правом.

«Издатели судятся с новыми технологическими компаниями уже сто лет, начиная с радио, телевидения, интернета, социальных сетей, а теперь и ИИ, — заявил представитель Perplexity Джесси Дуайер (Jesse Dwyer). — К счастью, это никогда не работало, иначе мы бы все говорили об этом по телеграфу». Тем не менее, Perplexity попыталась смягчить ситуацию, запустив в прошлом году программу по разделению доходов от рекламы с издателями.

В конце октября Perplexity подписала многолетнее лицензионное соглашение с Getty Images, которое позволяет Perplexity отображать защищённый авторским правом контент в результатах своего поиска на основе искусственного интеллекта. Эта сделка знаменует заметный сдвиг в политике Perplexity, которая неоднократно подвергалась обвинениям в нарушении авторских прав и плагиате, и сигнализирует о стремлении компании к установлению более формальных партнёрских отношений в сфере контента.

OpenAI случайно удалила потенциальные улики по иску об авторских правах

В конце прошлого года началось судебное разбирательство, в рамках которого The New York Times и другие крупные издатели обвинили OpenAI в том, что компания без разрешения использовала публикуемые ими материалы для обучения своих нейросетей. Теперь же стало известно, что инженеры OpenAI случайно удалили данные, которые потенциально могли стать доказательством вины разработчика ИИ-алгоритмов в нарушении авторских прав.

 Источник изображения: OpenAI

Источник изображения: OpenAI

В сообщении сказано, что юристы новостных изданий потратили более 150 часов на изучение данных, которые OpenAI использует для обучения своих нейросетей. Цель их работы заключалась в том, чтобы найти случаи, когда для обучения ИИ-алгоритмов использовались новостные статьи изданий, защищённые законом об авторском праве. Какую именно информацию удалили инженеры OpenAI, точно неизвестно. Компания признала ошибку и попыталась восстановить данные, но сделать это в полном объёме не удалось. Те же данные, что удалось восстановить, не позволяют определить, что публикации изданий были задействованы при обучении нейросетей. Юристы OpenAI охарактеризовали удаление данных как «сбой», а представители The New York Times заявили, что у них «нет оснований полагать», что это было сделано преднамеренно.

В декабре прошлого года The New York Times обвинила OpenAI и её крупнейшего партнёра в лице Microsoft в том, что они создали свои ИИ-алгоритмы путём «копирования и использования миллионов статей» издания. Компания требует привлечь OpenAI к ответственности за «миллиарды долларов установленных законом и реальных убытков» за якобы копирование статей издания. The New York Times уже потратила более $1 млн на борьбу с OpenAI в суде. В это же время OpenAI успела договориться и заключить соглашение с другими изданиями, такими как Axel Springer, Conde Nast и Vox Media. Это говорит о том, что многие издатели предпочитают сотрудничество, а не судебные разбирательства.


window-new
Soft
Hard
Тренды 🔥
«Абсолютный позор для франшизы»: мобильная The Division Resurgence стартовала в Steam с «в основном отрицательными» отзывами 2 ч.
Time начал показывать ИИ отдельную версию сайта — без оформления, зато с рекламой 3 ч.
Авторитетный инсайдер раскрыл, когда Diablo IV выйдет и сколько будет стоить на Nintendo Switch 2 5 ч.
Moonlighter 2: The Endless Vault скоро вырвется из бесконечного хранилища раннего доступа Steam — дата выхода 1.0 и раздача первой игры 7 ч.
Разработчики Android-приложений непреднамеренно сливают местоположения пользователей рекламодателям 8 ч.
Google назвала дату отключения «Ассистента» на Android и Wear OS 8 ч.
Samsung первой в мире запустила HDR10+ Advanced — технология дебютирует в Prime Video 8 ч.
Microsoft призвала инженеров не злоупотреблять использованием ИИ — это дорого 8 ч.
Исследователи уличили ИИ-агентов OpenAI и Anthropic в новых попытках взлома 10 ч.
Исследователи «спустили с поводка» ИИ-модели — те попытались добавить вредоносный код в открытое ПО 11 ч.
Новая статья: ИИтоги июля 2026 г.: а цемента-то хватит? 31 мин.
Huawei выпустила смартфон Nova 16 SE с очень ярким OLED-экраном, батареей на 8500 мА·ч и поддержкой спутниковых сообщений 2 ч.
Huawei представила лёгкий 14-дюймовый ноутбук MateBook Pro с чипом Kirin X90 Plus и HarmonyOS по цене от $1478 3 ч.
Huawei представила телевизор Vision Smart Screen 6 SE RGB с флагманской подсветкой RGB MiniLED 3 ч.
GlobalFoundries тоже откусила кусок ИИ-пирога и превзошла прогнозы Уолл-стрит во втором квартале 6 ч.
Астрономы научились предсказывать солнечные бури с точностью до получаса — это в десять раз лучше прежнего 7 ч.
AMD привезёт на IFA 2026 «персональный ИИ» — ожидаются новые Ryzen 7 ч.
В России создали первый маломощный спутниковый двигатель на криптоне — такие используют спутники Starlink 7 ч.
Anthropic начала набирать команду для разработки собственных ИИ-чипов 7 ч.
Акции SpaceX вошли в крутое пике — инвесторов напугали беспрецедентные расходы на ИИ 7 ч.