Сегодня 13 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Reddit подал в суд на Perplexity за нелегальный скрапинг данных для ИИ

Платформа Reddit подала в суд на компанию Perplexity и трёх поставщиков сервисов веб-скрапинга — SerpApi, Oxylabs и AWMProxy, обвинив их в массовом несанкционированном сборе защищённых данных с сайта социальной сети для обучения искусственного интеллекта (ИИ). В иске утверждается, что Perplexity, разработчик ИИ-поисковика, использует данные, полученные через этих посредников, вместо того чтобы заключить прямое соглашение с Reddit, как это сделали некоторые другие компании, работающие в сфере ИИ.

 Источник изображения: Reddit

Источник изображения: Reddit

Согласно иску, как стало известно The Verge, в мае 2024 года Reddit направил Perplexity официальное требование о прекращении скрапинга контента, на что компания заявила, что не использует данные Reddit для обучения своих моделей и соблюдает правила, прописанные в файле robots.txt. Однако вскоре после этого количество цитирований Reddit в ответах Perplexity, по утверждению истца, возросло.

Reddit подчёркивает, что миллионы тематических постов, созданных пользователями, представляет значительную ценность для обучения ИИ и даже заключила соглашения с OpenAI и Google, а также в 2023 году ввела платный API, стремясь получать компенсацию за использование своих данных.

Бен Ли (Ben Lee), главный юридический директор Reddit, заявил, что «компании, занимающиеся разработкой искусственного интеллекта, втянуты в гонку вооружений за качественный контент, созданный людьми, и это давление привело к развитию экономики "отмывания данных" в промышленных масштабах». Он назвал литовского скрапера Oxylabs UAB, ботнет-структуру AWM Proxy и SerpAI, открыто рекламирующие методы обхода защиты, типичными представителями такой незаконной деятельности. По его словам, эти компании (ответчики по делу), не имея прямого доступа к Reddit, маскируют свои скрипты и местоположение, чтобы красть контент через поисковую выдачу Google, а Perplexity сознательно приобретает эти украденные данные, избегая легального сотрудничества.

В свою очередь, Джесси Двайер (Jesse Dwyer), руководитель отдела коммуникаций Perplexity, сообщил изданию The Verge, что компания пока не получала иск, но намерена решительно отстаивать право пользователей свободно и справедливо получать доступ к публичным знаниям. Он подчеркнул, что подход Perplexity остаётся принципиальным и ответственным, а угрозы открытости и общественным интересам компания терпеть не намерена.

Ранее Reddit также подавала в суд на Anthropic по аналогичным основаниям, утверждая, что боты Anthropic получили доступ к платформе Reddit, даже после того как Anthropic заявила, что не будет этого делать.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Техногиганты в этом году успели сократить 128 000 сотрудников: больше, чем за весь прошлый год 7 ч.
США жертвуют экологией ради ИИ: администрация Трампа ослабила требования — это может затронуть миллионы людей 17 ч.
NewPhotonics представила оптический движок NPC50506 на 6,4 Тбит/с с интегрированным лазером 18 ч.
ASUS выпустила СХД высокой плотности OJ340A-RS60 на базе AMD EPYC Genoa 18 ч.
Asus представила монитор ProArt Display OLED PA27UCDV для профессионалов 21 ч.
Biostar внезапно начала продвигать видеокарту GeForce GT 730 на чипе из 2014 года 22 ч.
Утекли характеристики Lenovo Googlebook 15 — он не сможет быть дешёвым 12-09 12:06
ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников 12-09 12:04
Anthropic спрогнозировала три сценария развития ИИ — от умеренного роста экономики до массовой безработицы 12-09 10:50
iPhone Duo не спасёт рынок складных смартфонов — Apple заберёт почти четверть рынка, но он почти не вырастет 12-09 08:40