Сегодня 19 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Геймплей ролевого экшена Fatekeeper от бывших разработчиков Titan Quest 2 порадовал фанатов Dark Messiah of Might and Magic 2 мин.
Выросшие в интернете зумеры использует пароли слабее, чем их дедушки и бабушки 33 мин.
Первое крупное обновление принесёт в Ghost of Yotei режим «Новая игра +» и не только — геймплейный трейлер и дата выхода 2 ч.
В ЕС готовят конец эпохе раздражающих cookie-окон — всё решится на уровне браузера 2 ч.
The Temple of Elemental Evil не заставит себя долго ждать — объявлена дата выхода в Steam переиздания культовой RPG от соавторов Fallout 3 ч.
В Центробанке не ждут, что россияне массово перейдут на цифровой рубль 3 ч.
Исследователи собрали базу из 3,5 млрд номеров WhatsApp — мессенджер сам их выдавал 3 ч.
TikTok защитит пользователей от ИИ-контента и вознаградит ответственных 4 ч.
Австралиец погиб, не сумев вызвать скорую с Samsung Galaxy — на смартфоне не было обновлено ПО 6 ч.
Люди начали массово заводить романы с ИИ — доходит до виртуальных браков и детей 7 ч.
На Луне открыли свежий метеоритный кратер — это напомнило о рисках колонизации спутника 25 мин.
По одному GPU на каждого американца: ИИ-облако Lambda привлекло ещё $1,5 млрд инвестиций на амбициозное развитие инфраструктуры 3 ч.
Уровень брака у ангстремного техпроцесса Intel 18A падает на 7 % в месяц — процессоры Panther Lake не за горами 3 ч.
TP-Link подала в суд на Netgear за клевету о связях с Китаем — под угрозой продажи на $1 млрд 3 ч.
Honor живьём показала Robot Phone с камерой на роборуке — официальный анонс намечен на март 3 ч.
Noctua выпустила чёрный флагманский кулер NH-D15 G2 chromax.black по цене от $160 3 ч.
Кризис в Красном море повлиял на проекты интернет-кабелей Google и Meta 3 ч.
132 «динамических» Arm-ядра и 12 каналов памяти: Microsoft представила процессоры Cobalt 200 для облака Azure 5 ч.
ЦЕРН разогнал производство антивещества в восемь раз: «10 лет назад это сочли бы научной фантастикой» 5 ч.
Новым ИТ-директором с Intel поделилась Adobe 6 ч.