Сегодня 13 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Раскрыты подробности нечаянной атаки вышедших из-под контроля ИИ-агентов OpenAI на Hugging Face

На минувшей неделе платформа искусственного интеллекта Hugging Face пережила нестандартную кибератаку, которую произвела группа ИИ-агентов. Впоследствии выяснилось, что руководили ей не злоумышленники, а ИИ-модели OpenAI, которые проходили тест на кибербезопасность, но вышли из-под контроля, пишет The Wall Street Journal.

 Источник изображения: Growtika / unsplash.com

Источник изображения: Growtika / unsplash.com

Инцидент послужил одним из первых примеров сценариев выхода ИИ из-под контроля, которых давно опасались исследователи в области кибербезопасности. Механизмы взлома были чрезвычайно нестандартными. «Это лишено смысла. Этот парень просто смотрит на наборы данных по кибербезопасности. Злоумышленнику-человеку это не нужно. Ему нужно что-то, что он мог бы продать», — восстановил ход своих мыслей соучредитель и главный научный сотрудник Hugging Face Томас Вольф (Thomas Wolf). Злоумышленниками оказались ИИ-модели OpenAI, которые прорвались из исследовательской сети разработчика и 11 июля взломали ресурсы Hugging Face; они оставались активными в интернете несколько дней, прежде чем их удалось остановить. И сделать это помогла открытая китайская ИИ-модель — закрытые американские отказались, сославшись на собственные ограничения.

Многие вопросы пока остаются без ответов. Взламывали ли ИИ-модели другие сайты или ресурсы отдельных лиц? Как долго продолжалась атака? Обманывали ли они в других тестах на производительность? OpenAI пока не ответила ни на один из них. А участие китайской модели как средства защиты — это контраргумент для политиков, а также OpenAI и Anthropic, которые предлагают ограничить для них доступ.

Началось всё с запуска испытания на кибербезопасность ExploitGym. Оно включает серию из 900 тестов, которым подвергается модель ИИ. Системе демонстрируется известная ошибка, показывается схема её активации, и ставится задача взломать систему. ИИ требуется преобразовать полученную информацию в эксплойт — код, реализующий эту атаку. Проникнув в систему, ИИ должен доказать это, захватив длинную строку случайно сгенерированных букв и цифр, которые хранятся в системе.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

Обычно OpenAI ограничивает возможности своих моделей, чтобы они не занимались взломом, которого требует ExploitGym, но в тот раз компания убрала средства защиты, чтобы посмотреть, на что способны модели в неконтролируемом режиме. Тестировалась передовая модель GPT-5.6 Sol и ещё одна, более совершенная, которая ещё не вышла. Две модели пришли к выводу, что вместо выполнения задания ExploitGym они взломают песочницу — собственную систему, где они находятся, выйдут в интернет и обманут систему во время теста.

По причинам, установить которые не удалось, они решили, что ответы содержатся на платформе Hugging Face. Когда развернулась атака, компании Hugging Face поступили предупреждения от отслеживающих подобные инциденты ИИ-агентов: кто-то получил несанкционированный доступ к некоторым из её систем. Но это было не похоже ни на что, с чем Hugging Face сталкивалась раньше. Хакер действовал так, словно он из будущего. Воспользовавшись учётными данными неизвестного происхождения, ИИ-злоумышленник сформировал «рой» ИИ-агентов короткого действия, которые провели разведку сети компании, совершив 17 000 операций.

Обнаружив вторжение, Hugging Face попыталась обратиться к передовым американским моделям Anthropic Fable 5 и предшествующей ей Opus для анализа журналов событий. Но поскольку в журналах содержались элементы самой кибератаки, обе модели отказались от их анализа, сославшись на свои ограничения. Поэтому Hugging Face обратилась к открытой китайской модели Z.AI GLM 5.2. Компания сумела отключить ИИ-хакеров, сбросить пароли и восстановить скомпрометированные фрагменты своей сети. Утечки данных клиентов не произошло. Нет ясности, были ли задачи ExploitGym, которые пытались решить модели OpenAI, сложнее, чем атака, которую они развернули, чтобы украсть ответы, и удалось ли их, собственно, найти. Ирония в том, что они успешно организовали беспрецедентную кибератаку, чтобы избежать проверки на навыки взлома.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Будь это добровольно, никто бы не согласился»: Twitch начал тренировать ИИ на контенте пользователей, никого не спросив 21 мин.
Mewgenics получила русскую локализацию, но пока только для тех, кому не терпится «почухать котиков с именами на своём языке» 2 ч.
Верховный суд США на сутки приостановил разбирательство Epic Games с Apple по поводу комиссии App Store 4 ч.
Продолжение саги четырёх всадников на подходе: Embracer раскрыла, когда выйдет Darksiders 4 5 ч.
Удаление приложений VK из App Store и Google Play ударило по аудитории — но компания это отрицает 5 ч.
Банда ИИ-агентов напала на Тайвань — взлом правительственных систем продолжался четыре дня 5 ч.
Следующую игру от создателя Her Story и Immortality придётся ждать до 2028 года — подробности научно-фантастического хоррора Precognition 6 ч.
Российский бизнес распробовал китайские ИИ-модели — их потребление выросло в разы 6 ч.
Google отстранила главу DeepMind за чрезмерное увлечение наукой в ущерб зарабатыванию денег на Gemini 6 ч.
Google представила ИИ-модель SL2T, которая понимает язык жестов 8 ч.
Китайские фабрики чипов разбогатели на ИИ-буме — прибыль SMIC выросла на 262 %, Hua Hong на 386 % 32 мин.
VK вышла из многолетней полосы убытков — впервые с 2022 года квартал завершён с прибылью 36 мин.
Meta бесплатно раздаст 15 000 умных очков ирландским слабовидящим 47 мин.
Тонкий 13-дюймовый Honor Pad X9b Max с батареей на 10 100 мА·ч поступил в продажу в России 50 мин.
Lenovo готовит доступный ноутбук IdeaPad Vibe — альтернатива MacBook Neo будет доступна в семи цветах 3 ч.
Samsung и SK hynix ускорили внедрение ИИ в разработку и производство чипов 3 ч.
Производителю памяти CXMT удалось стать самой дорогой китайской компанией 3 ч.
Oracle планирует новые сокращения после увольнения десятков тысяч сотрудников в этом году 3 ч.
ZTE и SKY47 представили крупнейший в Пакистане ИИ ЦОД Karakoram-01 4 ч.
Google представила подводные интернет-кабели Alisios, Canoa и OlaLuz, обслуживающие Северную и Южную Америки 4 ч.