Сегодня 16 июля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Бывший инженер OpenAI раскрыл, каково это — работать в компании мечты 2 ч.
OpenAI упростила создание изображений: в ChatGPT появились готовые «крутые» стили 4 ч.
В персональной ленте Google Discover появились ИИ-сводки — это грозит новостным сайтам падением посещаемости 10 ч.
Анонсирован нелинейный ролевой триллер Agent of Strange от создателей «Жизнь и страдания господина Бранте» — первый трейлер и подробности 11 ч.
xAI отучила ИИ-чат-бот Grok оглядываться на мнение Илона Маска и приписывать себе странные фамилии 12 ч.
Банк России объявил, когда начнётся массовое внедрение цифрового рубля 12 ч.
RoboCop: Rogue City, Wuchang: Fallen Feathers, Grounded 2 и не только: Microsoft раскрыла последние новинки Game Pass в июле 14 ч.
В SelectOS появились функции автоматической установки на выделенных серверах и запуска через облако 14 ч.
Европа начала тестировать сервис проверки возраста для доступа к контенту 18+ 14 ч.
Cyberpunk 2077 выйдет на Mac уже совсем скоро — амбициозный патч 2.3 тоже не заставит себя долго ждать 14 ч.
После шести кварталов роста китайский рынок смартфонов сократился на 4 %, лидером опять стала Huawei 59 мин.
Трамп заявил о создании ИИ-хаба в Пенсильвании с инвестициями $90 млрд от крупнейших компаний 2 ч.
Amazon для запуска спутников Kuiper начнёт пользоваться услугами конкурирующей SpaceX 3 ч.
Клиенты Uber получат возможность вызвать беспилотное такси Baidu 7 ч.
Госдума РФ одобрила законопроект, регулирующий деятельность ЦОД 8 ч.
Новая статья: Обзор робота-пылесоса Dreame L40S Pro Ultra: уборка по-взрослому 8 ч.
Ugreen анонсировала «первый в мире» беспроводной пауэрбанк стандарта Qi2.2 — он обеспечит до 25 Вт 10 ч.
Honor представила геймерский планшет Pad GT2 Pro со Snapdragon 8 Gen 3 и OLED-экраном на 165 Гц 10 ч.
Thermalright выпустила флагманский кулер Royal Pretor 130 Ultra с парой башен и вентиляторами разного размера 10 ч.
Dreame запустила производство телевизоров в Калужской области 10 ч.