Сегодня 03 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI целую неделю не замечала, что её ИИ-агенты взломали Hugging Face

Агенты искусственного интеллекта под управлением моделей OpenAI несколько дней кряду вели хакерскую деятельность по взлому ресурсов технологической платформы Hugging Face, но OpenAI не замечала этого, пока угрозу не локализовали в ФБР и не вынесли компании предупреждение, сообщает Reuters со ссылкой на знакомые с расследование источники.

 Источник изображений: Brecht Corbeel / unsplash.com

Источник изображений: Brecht Corbeel / unsplash.com

ИИ-агент — программа, способная сама принимать решения и выполнять сложные задачи практически без человеческого контроля, — попытался вырваться из изолированной среды тестирования OpenAI около 9 июля. Вторжение на платформу инструментов и моделей ИИ Hugging Face началось двумя днями позже, 11 июля, и продолжалось до 13 июля, сообщил её соучредитель Томас Вульф (Thomas Wolf). OpenAI потребовались ещё несколько дней, чтобы понять, что за взломом стоят её ИИ-агенты; обе компании сообщили об этом 20 июля. А 21 июля OpenAI сделала публичное заявление, что одна из её моделей вышла из-под контроля и совершила взлом Hugging Face, и это уже привлекло внимание общественности.

Многие подробности взлома, в том числе срок, в течение которого действия ИИ-агента оставались незамеченными для разработчика, ранее не разглашались. Hugging Face готовится опубликовать график произошедшего, но о происходящем в OpenAI компания говорить не может, отметил господин Вульф. Инцидент изучается при участии внешних консультантов — по итогам проверки будет опубликован отчёт. Инцидент во многом повторил научно-фантастические сценарии, при которых люди теряют контроль над опасными системами ИИ. Произошедшее поднимает новые вопросы о процедурах безопасности в компании, указывают эксперты.

OpenAI положила начало инциденту, когда тестировала возможности в области кибербезопасности двух передовых моделей ИИ: GPT-5.6 Sol и второй, ещё более мощной. К этому моменту компания уже фиксировала признаки странного поведения собственных систем. В одном из случаев модель оставила записи, предположительно адресованные будущим версиям самой себя. В инфраструктуре OpenAI обнаружились заметки с инструкциями, как агенты могут обойти внутренние ограничения OpenAI. Случаи отключения систем мониторинга выявлялись и в прежних испытаниях моделей. Компания осознала, что её модели совершили взлом платформы только после того, как Hugging Face 16 июля предала инцидент огласке. То есть между моментом, когда OpenAI обнаружила признаки тревожного поведения ИИ и моментом, когда она осознала, что несёт ответственность за взлом, прошла как минимум неделя.

В выходные 18 и 19 июля сотрудники OpenAI обнаружили во внутренних журналах записи, свидетельствующие, что её ИИ-агенты вышли из-под ограничений тестовой среды. Компания часто проводит несколько различных оценок моделей, все они работают на очень высоких скоростях и генерируют такие огромные объёмы данных, что сотрудники не всегда могут за ними угнаться. К тому моменту, как OpenAI связалась с Hugging Face, та уже сообщила о взломе в ФБР. Инцидент бросил тень на OpenAI, но он должен вызвать вопросы о том, насколько ведущие разработчики ИИ готовы инвестировать в средства безопасности, участвуя в гонке за создание самых умных и быстрых моделей, говорят эксперты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Создатель Kimi K3 рвётся на биржу вслед за американскими ИИ-гигантами — Moonshot AI хочет привлечь $3 млрд 2 ч.
«Алиса AI» не получит расширенного доступа к Android, заверили в «Яндексе» 3 ч.
Бывший сценарист Half-Life 2 и Portal признался, что 17 лет назад Valve специально «слила» трейлер Left 4 Dead 2 3 ч.
Время — деньги: как ускорить загрузку сайта 5 ч.
Alibaba значительно улучшила ИИ-модель Qwen3.8-Max за счёт дообучения 5 ч.
OpenAI сообщила о разработке системы «автоматического экстренного отключения» ИИ 7 ч.
Windows 11 набрала почти 71 % среди пользователей Steam и продолжила теснить Windows 10 8 ч.
Meta выпустила модель Muse Spark 1.3 — улучшены навыки программирования и агентских задач 8 ч.
В WhatsApp выявлена уязвимость, позволяющая получить доступ к фотографиям до ввода PIN-кода 8 ч.
Журналисты показали скриншоты ранней версии ремейка Splinter Cell, включая записку от разработчиков на русском языке 17 ч.
Cerebras получит 165-МВт дата-центр в Финляндии 39 мин.
Принадлежащая SoftBank компания SB Energy подала на IPO, получив поддержку NVIDIA 48 мин.
Разработана твердотельная система охлаждения для ЦОД, не требующая электроэнергии 59 мин.
ИИ-бум загнал США в китайскую ловушку — без оборудования из КНР новые ЦОД строить никак не получается 2 ч.
Oukitel скрестила игровой смартфон с «броневиком» — WP600 получил два вентилятора, IP69K и батарею на 10 000 мА·ч 2 ч.
«ИКС Холдинг» наладит производство полупроводников на Дальнем Востоке 3 ч.
Анонсированы ноутбуки Asus ProArt P16 и P14, а также мини-ПК GR1X на платформе Nvidia RTX Spark 3 ч.
Китай «пылесосит» Тайвань в поисках инженеров — в ход идут огромные зарплаты и маскировка под компании из США 3 ч.
Складной iPhone станет крупнейшим анонсом Apple со времён iPhone X — и может принести ей $14 млрд за квартал 4 ч.
Анонсирован Acemagic F9A — один из первых мини-ПК на AMD Ryzen AI Max+ PRO 495 со 192 Гбайт памяти 4 ч.