Сегодня 29 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Разработчики открытого ПО объявили партизанскую войну сборщикам данных для ИИ

Боты, которые массово собирают данные с веб-страниц для обучения и работы моделей искусственного интеллекта, становятся всё более ощутимой проблемой для владельцев сайтов. Некоторые разработчики начали давать отпор этим системам оригинальными способами, которые могут показаться наивными или ироничными, но во многих случаях они работают.

 Источник изображения: Ticka Kao / unsplash.com

Источник изображения: Ticka Kao / unsplash.com

Атаке веб-сканера сегодня может подвергнуться любой сайт. Иногда сайты даже теряют работоспособность, но сильнее прочих страдают разработчики ПО с открытым кодом: на сайтах таких проектов выкладываются материалы для скачивания, но ресурсов у них меньше, чем у коммерческих проектов. Проблема в том, что ИИ-боты игнорируют директивы файлов robot.txt, в которых указываются запрещённые для сканирования разделы. В январе разработчик открытого ПО Се Ясо (Xe Iaso) опубликовал в блоге «крик о помощи», рассказав о неподобающих действиях AmazonBot. Этот бот неустанно бил по Git-серверу разработчика, устраивая настоящие DDoS-атаки. Он игнорировал директивы robot.txt, менял IP-адреса, подменял значения строки User agent и прибегал к другим уловкам.

В итоге Ясо разработал программу Anubis, которая проводит проверку подключающихся к серверу Git клиентов — она блокирует ботов, но пропускает браузеры, которыми пользуются люди. Проект Anubis был опубликован на GitHub 19 марта, и всего за несколько дней он собрал 2000 звёзд, 20 участников и 39 форков. Успех программы указывает, что случай Ясо не уникален: на агрессивное поведение ИИ-ботов указал основатель и гендиректор платформы SourceHut Дрю ДеВолт (Drew DeVault), которому приходится от 20 % до 100 % рабочего времени тратить на защиту от веб-сканеров. Администратору проекта Linux Fedora Кевину Фензи (Kevin Fenzi) в какой-то момент пришлось полностью заблокировать Бразилию, а разработчик KDE Plasma Никколо Венеранди (Niccolò Venerandi) однажды временно заблокировал все китайские IP-адреса.

В январе анонимный разработчик под ником Aaron выпустил решение под названием Nepenthes в честь кувшиночника — насекомоядного растения. Система заманивает ИИ-ботов в «лабиринт» бесполезного контента, заставляя их сканировать чушь. Аналогичное решение недавно представила Cloudflare — оно получило более очевидное название AI Labyrinth. Эта система подключается, когда боты не соблюдают директиву «no crawl», — в результате они попусту тратят время и ресурсы. Дрю ДеВолт вообще призвал бойкотировать все новомодные ИИ-инструменты, в том числе большие языковые модели, генераторы изображений и GitHub Copilot. Едва ли это случится в действительности, поэтому разработчикам открытого ПО приходится подключать смекалку.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Разработчики Greedfall и Steelrising подтвердили закрытие студии — DLC для Greedfall: The Dying World выпустит Nacon, «а потом всё» 30 мин.
Microsoft встроит ИИ в «Часы» в Windows 11 — и превратит их в приложение для повышения концентрации 2 ч.
«Один из лучших месяцев в истории»: Sony приятно удивила фанатов майской подборкой игр PS Plus 2 ч.
Новый трейлер подтвердил дату выхода Phonopolis — авангардной головоломки от создателей Samorost и Machinarium 3 ч.
Google TV получит новые ИИ-функции, а на главном экране появятся YouTube Shorts 4 ч.
Во время майских праздников в Москве могут отключить мобильный интернет 4 ч.
Симулятор выживания в заброшенной сибирской деревне Midnight Watcher: Village получил атмосферный трейлер 4 ч.
Microsoft опубликовала исходники 86-DOS и PC-DOS 1.00 с дополнительными материалами — распечатки пылились в гараже больше 45 лет 4 ч.
Представлен десктопный ИИ-агент Amazon Quick — он выполняет часовые задачи за минуты 4 ч.
Спустя почти два года пираты всё-таки взломали Denuvo в Black Myth: Wukong — гипервизор не требуется 5 ч.
ИИ ЦОД Project Jupiter для OpenAI запитают от топливных элементов Bloom Energy мощностью 2,45 ГВт 13 мин.
Китайские учёные преуспели в превращении углекислого газа в керосин — к этому подтолкнул иранский кризис 30 мин.
Motorola представила смартфон Moto G87 c Dimensity 6400 и 200-Мп камерой за €399 33 мин.
Ozon разрабатывает собственный WAF 49 мин.
Motorola выпустила глобальную версию Razr 70 Plus со Snapdragon 8s Gen 3, парой 50-Мп камер и батареей на 4500 мА·ч 50 мин.
Motorola представила смартфоны-раскладушки Razr 70 и Razr 70 Ultra — изменений мало, но цены выше 2 ч.
Мониторы Philips Evnia получили функцию AmbiScape для синхронизации умных светильников с играми 2 ч.
Поставки кремниевых пластин в первом квартале 2026 года выросли на 13 % благодаря буму ИИ 2 ч.
Китай пригрозил ответными мерами в случае запрета в ЕС оборудования Huawei 4 ч.
Caviar представила четвёрку розовых iPhone 17 Pro и Pro Max, украшенных золотом и бриллиантами 4 ч.