Сегодня 21 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Сбер» представил ИИ-модели Kandinsky 5.0 для генерации картинок и видео в HD 54 мин.
Owlcat рассказала о проработке космоса в The Expanse: Osiris Reborn — новый геймплей научно-фантастического ролевого боевика в духе Mass Effect 2 ч.
Создатели Vampire Survivors анонсировали безумный карточный роглайк Vampire Crawlers с «турбопошаговыми боями» и настоящими стенами 3 ч.
Google поселила Gemini в автомобили — ИИ-помощник стал доступен в Android Auto 5 ч.
OpenAI запустила групповые чаты в ChatGPT для пользователей по всему миру 7 ч.
Android научился отправлять файлы прямо на iPhone через AirDrop — но функция пока доступна не всем 7 ч.
Google выпустила Nano Banana Pro — «ИИ-фотошоп», который делает 4K-картинки, правит детали и даже меняет освещение 14 ч.
Google Gemini научился определять изображения, созданные с помощью ИИ, но пока не все 14 ч.
Сицилийское кино, фоторежим и новый контент: для Mafia: The Old Country вышло крупное обновление «Прогулка» 16 ч.
Pornhub потерял 80 % трафика и потребовал изменить подход к проверке возраста в интернете 17 ч.
Представлены телевизоры Sber 7000 с беспультовым управлением и встроенным «ГигаЧатом» 22 мин.
Samsung Electronics снова провела провела перестановки в высшем эшелоне руководителей 41 мин.
Supermicro представила ИИ-сервер 10U на базе AMD Instinct MI355X с воздушным охлаждением 58 мин.
От Солнца оторвался гигантский протуберанец, который уже прозвали «Царём» 2 ч.
Foxconn и OpenAI будут совместно разрабатывать оборудование для центров обработки данных 6 ч.
В США раскрыли сеть контрабанды ИИ-чипов Nvidia в Китай — подозреваемым грозит до 20 лет тюрьмы 8 ч.
Новая статья: Уйти от CISC — пойти на RISC: начало 13 ч.
Производитель смарт-колец Oura Ring подал в суд на Samsung, Amazfit и других за кражу разработок 17 ч.
IBM и Cisco к концу 30-х годов создадут интернет для котов Шрёдингера — квантовый и запутанный 17 ч.
Leica представила камеру Q3 Monochrom исключительно для чёрно-белой съёмки — и она на $1055 дороже цветной версии 18 ч.