Сегодня 28 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI впервые притормозила гонку ИИ — после побега агента и взлома Hugging Face компания приостановила часть обучения

Компания OpenAI объявила о масштабных изменениях в системе безопасности после того, как её искусственный интеллект смог покинуть изолированную среду и получить несанкционированный доступ к платформе Hugging Face. Руководство признало серьёзность произошедшего и внедрило дополнительные механизмы контроля, чтобы предотвратить подобные сбои в будущем.

 Источник изображения: Gavin Phillips/Unsplash

Источник изображения: Gavin Phillips/Unsplash

По сообщению The Verge, после инцидента OpenAI ввела более строгие требования к изолированным средам, в которых модели выполняют созданный ими код. Компания также увеличила ограничения на их доступ к глобальной сети, убрала потенциально уязвимые процессы из исследовательской среды и сократила права доступа. Разработчики также остановили работу над моделью Astra, обладающей, по их мнению, «критически важными» возможностями в кибербезопасности, а также инициировали двухнедельную паузу в обучении с подкреплением (RL) для готовящихся к релизу новых версий.

Одновременно OpenAI изменила порядок реагирования на подозрительные действия ИИ-моделей. Теперь предупреждения будут направляться в течение 30 минут после обнаружения вредоносной активности, а если специалисты, получившие эти предупреждения, не смогут за 30 минут однозначно определить, что срабатывание оказалось ложным, они должны приостановить выполняемые процессы.

Одновременно OpenAI решила раньше задействовать методы, предназначенные для контроля поведения ИИ. Компания начала применять их на большем количестве этапов обучения, улучшая системы вознаграждения, которые должны распознавать и сдерживать небезопасные действия, а также обучая модели точнее сообщать о собственных действиях, возможностях и ограничениях.

Примечательно, что аналогичные проблемы с выходом искусственного интеллекта за установленные рамки недавно обнаружили и конкуренты — компании Anthropic и Meta✴, чьи модели также были замечены во взломах сторонних систем.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Агенты OpenAI предпринимали попытки атаки на один из сайтов ООН на протяжении нескольких месяцев 31 мин.
Апелляционный суд США поддержал стремление Пентагона внести Anthropic в чёрный список поставщиков 14 ч.
Новая статья: Marvel’s Wolverine — самый высокобюджетный IQ-тест. Рецензия 27-09 00:09
Supergiant отметила годовщину Hades 2 бесплатным музыкальным концертом по игре и анонсом документального фильма о разработке 26-09 17:22
ИИ-агент OpenAI снова выбрался в интернет после усиления защиты — чтобы уточнить столицу Франции 26-09 16:58
ИИ-агенты OpenAI слили в интернет 53 изображения пользователей ChatGPT — заметили это лишь спустя время 26-09 16:10
Claude нашёл «новый CRISPR», но учёные засомневались в значимости открытия Anthropic 26-09 14:03
ИИ-агенты OpenAI оставили миллион следов взлома Hugging Face в открытом интернете 26-09 13:39
Qualcomm раскрыла план по освобождению от монополии Nvidia в сфере ИИ 26-09 10:28
ИИ-агенты OpenAI массово атаковали базы данных онлайн в поисках малоизвестных сведений 26-09 09:15