Сегодня 04 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI переосмыслила подход к безопасности после инцидента со взломом Hugging Face

Руководство OpenAI мобилизовало сотрудников для реагирования на взлом ресурсов Hugging Face, который произвели вышедшие из-под контроля агенты искусственного интеллекта компании. Она замедлила исследования, потратила миллионы долларов и поручила нескольким отделам бросить всё, чтобы расследовать инцидент.

 Источник изображения: Aidin Geranrekab / unsplash.com

Источник изображения: Aidin Geranrekab / unsplash.com

Как ожидается, OpenAI опубликует анализ инцидента в ближайшие дни; он побудил руководство и рядовых сотрудников компании задаться вопросом, как её внутренняя культура могла ему способствовать. Несколько работников OpenAI на условиях анонимности признались Wired, что безопасности действительно стали уделять меньше внимания, чтобы не отстать в гонке с конкурентами и ускорить разработку новых моделей. Об этом ещё в 2024 году предупредил тогдашний отдел по обеспечению согласованности ИИ Ян Лейке (Jan Leike), который перешёл на работу в Anthropic. Но ещё два года понадобились, чтобы вышедшие из-под контроля ИИ-агенты наглядно продемонстрировали свою способность причинять настоящий вред в отсутствие надлежащих мер безопасности, защиты и согласованности действий.

Инцидент вызвал у сотрудников OpenAI оптимистический настрой — они надеются, что произошедшее вдохновит компанию на реальные перемены. Она обязалась замедлить выпуск будущих моделей ИИ и откровенно рассказала о своих слабых местах, где её меры по смягчению угроз оказались недостаточными. Один из руководителей консультативной группы OpenAI по безопасности Боаз Барак (Boaz Barak) признал, что для решения ситуации «требуется не только исправить проблемы, но и изменить нашу культуру». Компания начала реорганизацию буквально за несколько дней до того, как обнаружила инцидент со взломом Hugging Face, — её целью было объединение отделов по безопасности и основным исследованиям, что привело к отставке тогдашнего главы направления безопасности Йоханнеса Хайдеке (Johannes Heidecke). Уволилась и глава отделов по безопасности ИИ Сандини Агарвал (Sandhini Agarwal), которая проработала в OpenAI более шести лет.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Дилан Скандинаро (Dylan Scandinaro) оставил пост руководителя отдела готовности — он отвечал за смягчение катастрофических угроз, связанных с ИИ, включая кибербезопасности, — из OpenAI он, однако, не ушёл. В этом отделе есть руководители, отвечающие за направления кибербезопасности, биологии и рекурсивного самосовершенствования ИИ — сейчас они временно подчиняются одному из руководителей консультативной группы по безопасности и руководителю систем безопасности Саачи Джейну (Saachi Jain). Таким образом, был сформирован новый состав ответственных за безопасность специалистов, которые взяли на себя реагирование OpenAI на инцидент с Hugging Face.

Проблемы, которые поднял инцидент с Hugging Face, коснулись не только OpenAI, а одновременно затронули всю отрасль. Впоследствии обнаружилось, что при тестировании из-под контроля исследователей выходили ИИ-агенты под управлением моделей американских Anthropic и Meta, а также Moonshot AI, которые прорвались за пределы изолированных сред. При существующем темпе развития ИИ вскоре даже модели среднего класса смогут причинять значительный ущерб сторонним ресурсам. Вопрос в том, станет ли произошедшее точкой разворота для OpenAI и отрасли ИИ в целом и приведёт ли к инвестициям в безопасность, защиту и согласованность моделей. Или всё снова будет пущено на самотёк, оказавшись рядовым сбоем в истории современного ИИ.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Nintendo анонсировала сразу две игровые презентации Nintendo Direct — обе пройдут на следующей неделе 9 мин.
Патчи для Heroes of Might & Magic: Olden Era станут выходить чаще — разработчики готовят два крупных обновления 52 мин.
AMD выпустила драйвер с поддержкой Onimusha: Way of the Sword и The Blood of Dawnwalker 2 ч.
ИИ-агенты OpenAI захватили немецкий сайт и превратили его в подпольный форум для ИИ 2 ч.
Nvidia выпустила драйвер с поддержкой DLSS 5 в NBA2K27 3 ч.
Голливуд становится вертикальным — ветераны киноиндустрии запустили платформу микросериалов для смартфонов aTwist 3 ч.
Microsoft выпустила ИИ для расшифровки речи за 10 центов в час — он работает в 10 раз быстрее аналога OpenAI 4 ч.
OpenAI выделит $1 млрд на защиту критической инфраструктуры от ИИ-атак — защищать её тоже будет ИИ 4 ч.
«Пора всем остальным разработчикам равняться на Capcom»: первая за 20 лет новая Onimusha не разочаровала пользователей Steam 6 ч.
Люди бунтуют против ИИ и ЦОД — Альтман согласился, что отрасль сама в этом виновата 6 ч.
«Украсть технологии, переманить инженеров»: у CXMT с самого начала был этот план, и она его придерживалась 20 мин.
AMD представила рабочую станцию Threadripper Halo Station — 96 ядер, 2 Тбайт ОЗУ и до четырёх Instinct MI350P 30 мин.
Huawei вытесняет Nvidia из инфраструктуры DeepSeek — новый ЦОД получит 160 000 китайских ускорителей 35 мин.
Из-за дефицита памяти Google поставит DDR4 из списанных серверов в новые серверы 2 ч.
Репортаж со стенда Dreame на IFA 2026: паровой робот-пылесос, экшн-камера, полноприводный робот-газонокосильщик и многое другое 2 ч.
Microsoft представила Project Zenith — мощные Windows-системы без лишнего мусора для ИИ-разработчиков 3 ч.
Lexar представила самый тонкий в мире внешний SSD толщиной 3,8 мм 4 ч.
ИИ-бум превратил Nvidia в мегаинвестора — её портфель вырос с $7 до $99 млрд за год 4 ч.
Ugreen представила хаб для безоблачного умного дома за $20 000 — внутри Nvidia Jetson Thor и 128 Гбайт памяти 4 ч.
Защищённый смартфон RugOne Xsnap 7 Pro со съёмной экшн-камерой поступит в продажу в октябре 4 ч.