Сегодня 11 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI впервые притормозила гонку ИИ — после побега агента и взлома Hugging Face компания приостановила часть обучения

Компания OpenAI объявила о масштабных изменениях в системе безопасности после того, как её искусственный интеллект смог покинуть изолированную среду и получить несанкционированный доступ к платформе Hugging Face. Руководство признало серьёзность произошедшего и внедрило дополнительные механизмы контроля, чтобы предотвратить подобные сбои в будущем.

 Источник изображения: Gavin Phillips/Unsplash

Источник изображения: Gavin Phillips/Unsplash

По сообщению The Verge, после инцидента OpenAI ввела более строгие требования к изолированным средам, в которых модели выполняют созданный ими код. Компания также увеличила ограничения на их доступ к глобальной сети, убрала потенциально уязвимые процессы из исследовательской среды и сократила права доступа. Разработчики также остановили работу над моделью Astra, обладающей, по их мнению, «критически важными» возможностями в кибербезопасности, а также инициировали двухнедельную паузу в обучении с подкреплением (RL) для готовящихся к релизу новых версий.

Одновременно OpenAI изменила порядок реагирования на подозрительные действия ИИ-моделей. Теперь предупреждения будут направляться в течение 30 минут после обнаружения вредоносной активности, а если специалисты, получившие эти предупреждения, не смогут за 30 минут однозначно определить, что срабатывание оказалось ложным, они должны приостановить выполняемые процессы.

Одновременно OpenAI решила раньше задействовать методы, предназначенные для контроля поведения ИИ. Компания начала применять их на большем количестве этапов обучения, улучшая системы вознаграждения, которые должны распознавать и сдерживать небезопасные действия, а также обучая модели точнее сообщать о собственных действиях, возможностях и ограничениях.

Примечательно, что аналогичные проблемы с выходом искусственного интеллекта за установленные рамки недавно обнаружили и конкуренты — компании Anthropic и Meta, чьи модели также были замечены во взломах сторонних систем.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Цукерберг хотел плоскую Meta, но ИИ всё изменил — пониженных сотрудников возвращают на руководящие должности 17 мин.
Ранний доступ в Google Play может превратиться в рассадник вредоносов 33 мин.
OpenAI научила ИИ говорить и слушать одновременно — полнодуплексная модель GPT-Live-1 доступна разработчикам 55 мин.
Google выпустила приложение Gemini для Windows 3 ч.
OpenAI приостановила приём новых подписчиков Pro — спрос на GPT-6 Astra оказался чрезмерным 4 ч.
Пропавший с радаров онлайн-шутер про ограбления Fairgames от Sony засветился на закрытом тестировании под подставным названием 4 ч.
Гонку ИИ пора притормозить, но это может быть незаконно — OpenAI попросила Конгресс разобраться 5 ч.
Anthropic предотвратила несколько попыток создания биологического оружия с помощью Claude 6 ч.
По мотивам «Блуждающей Земли» выйдет амбициозный сюжетный боевик The Wandering Earth: The Last Full Moon — первый трейлер и подробности 6 ч.
Власти России хотят сделать «Алису AI» обязательной и неудаляемой на всех смартфонах 6 ч.