Сегодня 28 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI впервые притормозила гонку ИИ — после побега агента и взлома Hugging Face компания приостановила часть обучения

Компания OpenAI объявила о масштабных изменениях в системе безопасности после того, как её искусственный интеллект смог покинуть изолированную среду и получить несанкционированный доступ к платформе Hugging Face. Руководство признало серьёзность произошедшего и внедрило дополнительные механизмы контроля, чтобы предотвратить подобные сбои в будущем.

 Источник изображения: Gavin Phillips/Unsplash

Источник изображения: Gavin Phillips/Unsplash

По сообщению The Verge, после инцидента OpenAI ввела более строгие требования к изолированным средам, в которых модели выполняют созданный ими код. Компания также увеличила ограничения на их доступ к глобальной сети, убрала потенциально уязвимые процессы из исследовательской среды и сократила права доступа. Разработчики также остановили работу над моделью Astra, обладающей, по их мнению, «критически важными» возможностями в кибербезопасности, а также инициировали двухнедельную паузу в обучении с подкреплением (RL) для готовящихся к релизу новых версий.

Одновременно OpenAI изменила порядок реагирования на подозрительные действия ИИ-моделей. Теперь предупреждения будут направляться в течение 30 минут после обнаружения вредоносной активности, а если специалисты, получившие эти предупреждения, не смогут за 30 минут однозначно определить, что срабатывание оказалось ложным, они должны приостановить выполняемые процессы.

Одновременно OpenAI решила раньше задействовать методы, предназначенные для контроля поведения ИИ. Компания начала применять их на большем количестве этапов обучения, улучшая системы вознаграждения, которые должны распознавать и сдерживать небезопасные действия, а также обучая модели точнее сообщать о собственных действиях, возможностях и ограничениях.

Примечательно, что аналогичные проблемы с выходом искусственного интеллекта за установленные рамки недавно обнаружили и конкуренты — компании Anthropic и Meta✴, чьи модели также были замечены во взломах сторонних систем.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Гендиров OpenAI и Anthropic вызвали на допрос в Сенат Австралии по делу о взломе правительственного сайта ИИ-агентом 4 мин.
DenuvOwO испугалась мести Denuvo хакеру voices38 — пиратская группировка в ответе за обход защиты более 60 игр распалась 22 мин.
Журналисты выяснили, почему Китай в отличие от Запада не боится «конца света» из-за ИИ 30 мин.
Первые обзоры Gears of War: E-Day выйдут за пять дней до официального релиза, но есть нюанс 2 ч.
«Это не пустышка»: амбициозный шутер с открытым миром StarCraft уже достиг играбельного состояния и будет «на 100 %» от Blizzard 3 ч.
Агенты OpenAI предпринимали попытки атаки на один из сайтов ООН на протяжении нескольких месяцев 7 ч.
ИИ уже сам планирует кибератаки — OpenAI, Anthropic и Google наняли стартап для поиска «злого» поведения моделей 17 ч.
Апелляционный суд США поддержал стремление Пентагона внести Anthropic в чёрный список поставщиков 20 ч.
Продажи Wardogs превысили три миллиона копий — шутер номинирован на премию Golden Joystick Awards 24 ч.
Новая статья: Marvel’s Wolverine — самый высокобюджетный IQ-тест. Рецензия 27-09 00:09