Сегодня 05 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → the new york times

The New York Times обвинила ИИ-стартап Perplexity в создании «дословных копий» своих статей

Издательство The New York Times (NYT) подало судебный иск на «систему ответов» ИИ-стартапа Perplexity. NYT утверждает, что Perplexity «незаконно сканирует, копирует, извлекает и распространяет» материалы с сайта издательства. По словам истца, ответы, предоставляемые ИИ-поисковиком Perplexity являются «дословными или существенно похожими копиями» материалов NYT, защищённых авторским правом.

 Источник изображения: unsplash.com

Источник изображения: unsplash.com

«Копируя защищённый авторским правом контент The Times и создавая на его основе замещающую продукцию, устраняя необходимость посещения веб-сайта The Times или покупки газеты, Perplexity незаконно присваивает себе значительные возможности получения дохода от подписки, рекламы, лицензирования и партнёрских программ, которые по праву принадлежат исключительно The Times», — говорится в иске NYT.

Иск был подан после неоднократных требований в адрес Perplexity о прекращении использования контента с сайта NYT. Такие уведомления направлялись неоднократно в течение последних двух лет, но были проигнорированы. NYT требует возмещения ущерба и просит суд навсегда запретить Perplexity заниматься подобной деятельностью. Газета Chicago Tribune также подала в четверг иск о нарушении авторских прав против Perplexity.

Perplexity стала объектом нескольких судебных исков после того, как Forbes и Wired обвинили стартап в обходе платного доступа к их сайтам и использования их контента. NYT выдвигает аналогичные обвинения в своём иске, заявляя, что роботы Perplexity «намеренно игнорировали или обходили технические меры защиты контента», такие как файл robots.txt, который прямо указывает на разделы сайта, которые боты не должны сканировать и индексировать.

В июне британская корпорация BBC (Би-би-си) пригрозила иском Perplexity, заявив, что «базовая модель искусственного интеллекта» американского стартапа «была обучена с использованием контента BBC». Для телекомпании это стало первой попыткой пресечь деятельность технологических стартапов, использующих огромные запасы контента BBC для обучения нейросетей.

В августе компания Cloudflare обвинила стартап Perplexity в массовом скрапинге веб-сайтов, которые явным образом запрещают сбор данных. Согласно исследованию Cloudflare, опубликованному 4 августа, боты Perplexity игнорировали технические ограничения, установленные в файле robots.txt, и продолжали извлекать и копировать контент с десятков тысяч доменов, создавая миллионы запросов ежедневно.

В сентябре «Британская энциклопедия» (Encyclopedia Britannica) и её дочерняя компания Merriam-Webster подали иск в федеральный суд Нью-Йорка против компании Perplexity AI, обвинив её в нарушении авторских прав и товарных знаков. В иске обе компании утверждают, что система ответов Perplexity копирует их сайты, крадёт интернет-трафик и занимается плагиатом их материалов, защищённых авторским правом.

«Издатели судятся с новыми технологическими компаниями уже сто лет, начиная с радио, телевидения, интернета, социальных сетей, а теперь и ИИ, — заявил представитель Perplexity Джесси Дуайер (Jesse Dwyer). — К счастью, это никогда не работало, иначе мы бы все говорили об этом по телеграфу». Тем не менее, Perplexity попыталась смягчить ситуацию, запустив в прошлом году программу по разделению доходов от рекламы с издателями.

В конце октября Perplexity подписала многолетнее лицензионное соглашение с Getty Images, которое позволяет Perplexity отображать защищённый авторским правом контент в результатах своего поиска на основе искусственного интеллекта. Эта сделка знаменует заметный сдвиг в политике Perplexity, которая неоднократно подвергалась обвинениям в нарушении авторских прав и плагиате, и сигнализирует о стремлении компании к установлению более формальных партнёрских отношений в сфере контента.

OpenAI случайно удалила потенциальные улики по иску об авторских правах

В конце прошлого года началось судебное разбирательство, в рамках которого The New York Times и другие крупные издатели обвинили OpenAI в том, что компания без разрешения использовала публикуемые ими материалы для обучения своих нейросетей. Теперь же стало известно, что инженеры OpenAI случайно удалили данные, которые потенциально могли стать доказательством вины разработчика ИИ-алгоритмов в нарушении авторских прав.

 Источник изображения: OpenAI

Источник изображения: OpenAI

В сообщении сказано, что юристы новостных изданий потратили более 150 часов на изучение данных, которые OpenAI использует для обучения своих нейросетей. Цель их работы заключалась в том, чтобы найти случаи, когда для обучения ИИ-алгоритмов использовались новостные статьи изданий, защищённые законом об авторском праве. Какую именно информацию удалили инженеры OpenAI, точно неизвестно. Компания признала ошибку и попыталась восстановить данные, но сделать это в полном объёме не удалось. Те же данные, что удалось восстановить, не позволяют определить, что публикации изданий были задействованы при обучении нейросетей. Юристы OpenAI охарактеризовали удаление данных как «сбой», а представители The New York Times заявили, что у них «нет оснований полагать», что это было сделано преднамеренно.

В декабре прошлого года The New York Times обвинила OpenAI и её крупнейшего партнёра в лице Microsoft в том, что они создали свои ИИ-алгоритмы путём «копирования и использования миллионов статей» издания. Компания требует привлечь OpenAI к ответственности за «миллиарды долларов установленных законом и реальных убытков» за якобы копирование статей издания. The New York Times уже потратила более $1 млн на борьбу с OpenAI в суде. В это же время OpenAI успела договориться и заключить соглашение с другими изданиями, такими как Axel Springer, Conde Nast и Vox Media. Это говорит о том, что многие издатели предпочитают сотрудничество, а не судебные разбирательства.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Control Resonant — дуализм прекрасного. Рецензия 04-10 00:05
Дорогие видеокарты не остановили покупки игр — Steam показала рекордный сентябрь 03-10 23:53
ФБР серьёзно взялось за хакеров ShinyHunters, взломавших ФБР — задержан ещё один подозреваемый 03-10 23:20
Capcom сделает RE Engine игровым движком для разработки с помощью ИИ 03-10 19:10
ИИ-агент OpenAI узнал о предстоящем отключении из переписки в Slack и планировал своё «спасение» 03-10 18:15
Microsoft готовит Windows и Surface к чипам Nvidia — подробности раскроют 7 октября 03-10 16:58
ИИ научился притворяться человеком в видеозвонках — модель Griffin прошла «видеотест Тьюринга» 03-10 15:00
OpenAI покинул глава команды безопасности — он сомневался, что компания успевает за собственным ИИ 03-10 14:47
Gemini 4 хороша в тестах, но буксует в работе — пожаловались сотрудники Google 03-10 10:19
Apple ужесточит контроль над «полным доступом к диску» в macOS из-за рисков, связанных с ИИ-агентами 03-10 07:43
Новая статья: Компьютер месяца — октябрь 2026 года 8 ч.
ИИ-бум успеет поменять мир прежде, чем закончатся деньги инвесторов 20 ч.
«Ночью все кошки серы»: Илон Маск пояснил, почему роботакси не обслуживают клиентов глубокой ночью 24 ч.
Трамп нашёл нового «ИИ-царя» — «Силами сверхинтеллекта» будет руководить глава нацразведки 24 ч.
Цены на HBM в следующем году увеличатся более чем в два раза 04-10 06:22
ASRock Industrial выпустила мини-компьютеры NUC Core 300 Box на платформе Intel Wildcat Lake 03-10 20:54
JEDEC представила первый в отрасли стандарт для кремниевой фотоники 03-10 20:53
Купленный с рук Ryzen достался новому владельцу вместе с «баном» в Valorant — античит узнал процессор читера 03-10 17:16
Чиповый мегапроект Маска стоимостью $119 млрд может получить поддержку TSMC 03-10 13:58
Samsung запустила серийное производство чипов Exynos 2700, но решение по Galaxy S27 Ultra ещё не принято 03-10 13:38