Сегодня 24 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI целую неделю не замечала, что её ИИ-агенты взломали Hugging Face

Агенты искусственного интеллекта под управлением моделей OpenAI несколько дней кряду вели хакерскую деятельность по взлому ресурсов технологической платформы Hugging Face, но OpenAI не замечала этого, пока угрозу не локализовали в ФБР и не вынесли компании предупреждение, сообщает Reuters со ссылкой на знакомые с расследование источники.

 Источник изображений: Brecht Corbeel / unsplash.com

Источник изображений: Brecht Corbeel / unsplash.com

ИИ-агент — программа, способная сама принимать решения и выполнять сложные задачи практически без человеческого контроля, — попытался вырваться из изолированной среды тестирования OpenAI около 9 июля. Вторжение на платформу инструментов и моделей ИИ Hugging Face началось двумя днями позже, 11 июля, и продолжалось до 13 июля, сообщил её соучредитель Томас Вульф (Thomas Wolf). OpenAI потребовались ещё несколько дней, чтобы понять, что за взломом стоят её ИИ-агенты; обе компании сообщили об этом 20 июля. А 21 июля OpenAI сделала публичное заявление, что одна из её моделей вышла из-под контроля и совершила взлом Hugging Face, и это уже привлекло внимание общественности.

Многие подробности взлома, в том числе срок, в течение которого действия ИИ-агента оставались незамеченными для разработчика, ранее не разглашались. Hugging Face готовится опубликовать график произошедшего, но о происходящем в OpenAI компания говорить не может, отметил господин Вульф. Инцидент изучается при участии внешних консультантов — по итогам проверки будет опубликован отчёт. Инцидент во многом повторил научно-фантастические сценарии, при которых люди теряют контроль над опасными системами ИИ. Произошедшее поднимает новые вопросы о процедурах безопасности в компании, указывают эксперты.

OpenAI положила начало инциденту, когда тестировала возможности в области кибербезопасности двух передовых моделей ИИ: GPT-5.6 Sol и второй, ещё более мощной. К этому моменту компания уже фиксировала признаки странного поведения собственных систем. В одном из случаев модель оставила записи, предположительно адресованные будущим версиям самой себя. В инфраструктуре OpenAI обнаружились заметки с инструкциями, как агенты могут обойти внутренние ограничения OpenAI. Случаи отключения систем мониторинга выявлялись и в прежних испытаниях моделей. Компания осознала, что её модели совершили взлом платформы только после того, как Hugging Face 16 июля предала инцидент огласке. То есть между моментом, когда OpenAI обнаружила признаки тревожного поведения ИИ и моментом, когда она осознала, что несёт ответственность за взлом, прошла как минимум неделя.

В выходные 18 и 19 июля сотрудники OpenAI обнаружили во внутренних журналах записи, свидетельствующие, что её ИИ-агенты вышли из-под ограничений тестовой среды. Компания часто проводит несколько различных оценок моделей, все они работают на очень высоких скоростях и генерируют такие огромные объёмы данных, что сотрудники не всегда могут за ними угнаться. К тому моменту, как OpenAI связалась с Hugging Face, та уже сообщила о взломе в ФБР. Инцидент бросил тень на OpenAI, но он должен вызвать вопросы о том, насколько ведущие разработчики ИИ готовы инвестировать в средства безопасности, участвуя в гонке за создание самых умных и быстрых моделей, говорят эксперты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
ИИ-биолаборатория Anthropic сделала первое открытие — найденную ферментную систему уже сравнивают с CRISPR 2 ч.
Хакер поручил ИИ-агентам взламывать интернет-магазины — украдены данные более 600 тыс. банковских карт 2 ч.
YouTube запустит новые ИИ-функции для блогеров — дубляж в реальном времени, анализ привлекательности видео и динамические миниатюры 6 ч.
YouTube представил «Пользовательские ленты» — теперь алгоритм рекомендаций можно настроить простыми словами 6 ч.
Control Resonant оказалась на торрентах за день до официального релиза 6 ч.
В Steam вышла демоверсия Dopros — нелинейного симулятора допроса в тоталитарной антиутопии 8 ч.
Titan Quest 2 не вырвется из раннего доступа Steam и Epic Games Store в 2026 году — новый трейлер и дата выхода версии 1.0 8 ч.
Microsoft удалит три мини-приложения, которые ещё недавно автоматически устанавливала в Windows 11 с Microsoft 365 10 ч.
Valorant получил крупный патч 13.06: новое оружие, временный режим, улучшенный интерфейс и точная оценка эффективности игроков 11 ч.
Graveyard Keeper 2 стартовала в Steam с «очень положительными» отзывами и уже обогнала первую часть по пиковому онлайну 11 ч.
Новая статья: Обзор и тест процессорного кулера Scythe FUMA 3: а что там в Японии? 42 мин.
Китайская YMTC добилась запрета для Micron в Германии — под угрозой поставки 3D NAND 2 ч.
Microsoft представила планшет Surface Pro 12 и ноутбук Surface Laptop 13 на базе Snapdragon X2 Plus 2 ч.
Qualcomm представила платформу Snapdragon Sound Elite Gen 2 для автономных наушников с ИИ и Wi-Fi 6E 3 ч.
Logitech представила G Pro X3 Superstrike — флагманскую игровую мышь с бесконтактными переключателями и 135 часами работы 6 ч.
В России стартовали продажи Xiaomi Redmi Note 17, 17 Pro и 17 Pro Max с ёмкими батареями и повышенной прочностью — от 21 990 рублей 6 ч.
Geely представила сверхбыструю ИИ-зарядку для электромобилей — с 10 до 70 % менее чем за пять минут 7 ч.
Брюссель наконец запустит систему оценки экоустойчивости дата-центров Евросоюза 7 ч.
Amazon пытается вернуть специалистов по ИИ и облакам, которых недавно уволила 7 ч.
Быстрая починка корабля Crew Dragon позволит отправить на МКС экипаж Crew-13 с россиянином уже 1 октября 7 ч.