Сегодня 23 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию»

«Википедия» расплачивается за бум искусственного интеллекта — онлайн-энциклопедия сталкивается с растущими расходами из-за ботов, которые копируют её статьи для обучения моделей искусственного интеллекта, что впустую расходует ресурсы и в разы увеличивает трафик и нагрузку на сайт. Только за последние три месяца трафик, генерируемый ИИ-краулерами, вырос на 50 %.

 Источник изображения: «Википедия»

Источник изображения: «Википедия»

Фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заявил, что «автоматизированные запросы на наш контент выросли в геометрической прогрессии». По данным фонда, с января 2024 года пропускная способность, используемая для загрузки мультимедийного контента, выросла на 50 %. Однако трафик исходит не от людей, а от автоматизированных программ, которые постоянно загружают изображения с открытой лицензией для передачи их моделям ИИ.

«Наша инфраструктура создана для того, чтобы выдерживать внезапные всплески трафика от людей во время мероприятий с высоким интересом, но объем трафика, генерируемого ботами-скрейперами, беспрецедентен и представляет растущие риски и расходы», — сообщила «Википедия».

Боты часто собирают данные из менее популярных статей «Википедии». Специалисты «Википедии» утверждают, что по крайней мере 65 % подобного трафика, поступает от ботов, что является непропорционально большим объёмом, учитывая, что общее количество просмотров страниц ботами составляет около 35 %. Также боты проявляют интерес к «ключевым системам в инфраструктуре разработчиков, таким как наша платформа проверки кода или наш баг-трекер», что ещё больше нагружает ресурсы сайта.

«Википедия» была вынуждена ввести индивидуальные ограничения скорости для ИИ-ботов или вообще запретить доступ некоторым из них. Но для решения проблемы в долгосрочной перспективе фонд разрабатывает план «Ответственного использования инфраструктуры». План предусматривает сбор отзывов от сообщества «Википедии» о способах определения трафика от ИИ-ботов и фильтрации их доступа.

Социальная платформа Reddit столкнулась с похожей проблемой в 2023 году. Например, Microsoft без уведомления Reddit использовала данные платформы для обучения моделей ИИ, что вынудило Reddit заблокировать ботов Microsoft. После этого инцидента Reddit решила взимать плату со сторонних разработчиков за доступ к своему API. Это привело к массовым протестам разработчиков и закрытию некоторых популярных форумов Reddit.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Тим Кук рассказал, какой была его первая большая ошибка на посту главы Apple 36 мин.
«Белый список» пополнили сайты и приложения банков, доставки, магазинов и волонтёрских организаций 50 мин.
BioWare слишком занята, чтобы показывать новую Mass Effect 54 мин.
ЦСР: В 2025 году российский рынок СУБД превысил 100 млрд руб. 60 мин.
«Игра года грядёт»: релизный трейлер научно-фантастического экшена Saros игроки встретили с восторгом 2 ч.
Режиссёр Escape from Tarkov объяснил, чем Fragmentary Order отличается от Arc Raiders — эвакуационного шутера для «казуальных людей» 2 ч.
Половину программного кода Google уже пишет ИИ — и его станет больше 3 ч.
Британские антимонопольщики дали ход коллективному «облачному» иску к Microsoft на £2 млрд 4 ч.
Selectel выпустила обновлённую ИИ-платформу с расширенными возможностями масштабирования моделей и внедрения в бизнес-процессы 4 ч.
VAST Data привлекла $1 млрд в раунде финансирования серии F 4 ч.
Илону Маску придётся вернуть Tesla $29 млрд чтобы получить давнюю премию в $56 млрд 2 мин.
Китай оценил мощность своей ИИ-инфраструктуры — оценки США были ниже в 6000 раз 5 мин.
Marvell приобрела Polariton, разработчика решений в области плазмоники 25 мин.
Эпоха возрождения компьютерных клубов в России: обороты выросли почти в 40 раз за пять лет и продолжают расти 25 мин.
NASA разгонит спрос на GPU среди учёных из-за лавины данных с новых телескопов 26 мин.
Беспилотный тягач Navio проехал по России 2800 км без водителя в кабине 2 ч.
ИИ-агент спроектировал полноценный процессор на RISC-V за 12 часов — промпт содержал всего 219 слов 2 ч.
DJI представила дроны для начинающих Lito 1 и X1 — 4К и автономность до 36 минут по цене от €309 3 ч.
Xiaomi, Oppo, Vivo и Honor объединились для борьбы с перегревом и зависанием смартфонов 3 ч.
Nvidia до сих пор не поставила ни единого ускорителя H200 в Китай — их там не принимают 4 ч.