Сегодня 25 сентября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Microsoft наконец анонсировала Forza Horizon 6, в том числе для PS5 — первый трейлер и подробности 17 мин.
Spinnaker объявила о бессрочной поддержке VMware vSphere 7 в связи с прекращением поддержки Broadcom 25 мин.
Неудачный переезд с SAP на Oracle продолжает опустошать бюджет Бирмингема — расходы выросли с £20 млн до £170 млн 2 ч.
Суверенный ChatGPT для Германии: SAP, OpenAI и Microsoft анонсировали проект OpenAI for Germany 2 ч.
Apple призвала ЕС отменить «Закон о цифровых рынках» — он мешает бизнесу и замедляет развитие 2 ч.
Цукерберг переманил из OpenAI ещё одного крупного исследователя в сфере ИИ 3 ч.
«Жду больше, чем GTA VI»: амбициозный боевик Saros от создателей Returnal обрадовал игроков геймплейным трейлером с датой выхода 4 ч.
Госдума приняла закон против автоматических списаний за онлайн-подписки 4 ч.
Google попросила Верховный суд США спасти её от решения по делу Epic 4 ч.
Премьера геймплея ролевой игры Zero Parades: For the Dead Spies: диалоги, загадки и наряды главной героини 5 ч.
Грядёт подорожание SSD: цены на память NAND вырастут на 5–10 % в четвёртом квартале 9 мин.
Отработавшие лопасти ветряков защитят Китай от распространения пустынь 14 мин.
Представлен компьютер-клавиатура Raspberry Pi 500+ за $200 — четыре ядра, механические переключатели и RGB-подсветка 18 мин.
Apple оправдалась за «царапины» на iPhone 17 Pro: это следы от MagSafe, а не дефект 2 ч.
ИИ-гонка увеличила мировые расходы на оборудование для производства чипов на 23 % во II квартале 3 ч.
КТ-сканирование показало скрытую опасность дешёвых литиевых аккумуляторов 3 ч.
Вместо тысяч рабочих мест Intel принесла жителям Огайо разбитые дороги и шум 3 ч.
Sony выпустила геймпад DualSense к юбилею God of War в пепельно-алой расцветке 3 ч.
В России поступили в продажу смартфоны Infinix HOT 60 Pro и HOT 60 Pro+ по цене от 12 990 рублей 3 ч.
Учёные NASA задумались о ядерном ударе по угрожающему Луне астероиду 3 ч.