Сегодня 03 июня 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Wildberries разрабатывает отечественный мессенджер — его уже используют сотрудники 2 ч.
Второе сюжетное дополнение к Vampire: The Masquerade — Bloodlines 2 завершит поддержку игры — трейлер и дата выхода The Flower & The Flame 2 ч.
Цукерберг хочет, чтобы ИИ Meta управлял всем бизнесом пользователей 3 ч.
Meta в европейском суде не смогла избавиться от статуса «привратника» 3 ч.
Колонку Creative превратили в инструмент для взлома ПК — компания уязвимость отрицает и исправлять не будет 3 ч.
Microsoft планирует «вызвать зависимость» пользователей от своего нового ИИ-помощника Scout 4 ч.
Новая игра разработчиков Shovel Knight обеспечила студии светлое будущее — раскрыты продажи Mina the Hollower 4 ч.
Meta, Microsoft, SpaceX и спецслужбы разгромили международную сеть интернет-мошенников 5 ч.
Исследователи создали червя на основе ИИ — он может использовать любую известную компьютерную уязвимость 6 ч.
В один день с Control Resonant выйдет психологический хоррор Silent Hill: Townfall — с туманным островом конца 90-х и видом от первого лица 9 ч.
Импортозамещение по-европейски: ЕС запустил большой план по снижению зависимости от США и Китая в чипах, ИИ и облаках 2 ч.
Запущен крупнейший в мире частный лазер — он должен приблизить эпоху термояда 3 ч.
Репортаж со стенда MSI на Computex 2026: материнские платы, уникальные видеокарты, СЖО, корпуса и блоки питания 4 ч.
Thermaltake показала CAPO X — огромный корпус за $190 для сборки сразу двух игровых ПК 5 ч.
Microsoft придумала очередной носимый ИИ-гаджет — умный бейдж с камерой 5 ч.
Xiaomi выпустила пауэрбанк на 20 000 мАч со встроенным кабелем USB-C за €19 5 ч.
AMD раскрыла детали EXPO ULL — бесплатный прирост FPS оказался проще, чем ожидалось 5 ч.
Enermax представила свой вариант СЖО, которая обходится без помпы 5 ч.
Инвесторы уверены, что человекоподобные роботы изменят жизнь людей и промышленность за 10 лет 5 ч.
Научное сообщество скептически отнеслось к квантовому процессору Microsoft Majorana 2 5 ч.