Сегодня 25 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI переосмыслила подход к безопасности после инцидента со взломом Hugging Face

Руководство OpenAI мобилизовало сотрудников для реагирования на взлом ресурсов Hugging Face, который произвели вышедшие из-под контроля агенты искусственного интеллекта компании. Она замедлила исследования, потратила миллионы долларов и поручила нескольким отделам бросить всё, чтобы расследовать инцидент.

 Источник изображения: Aidin Geranrekab / unsplash.com

Источник изображения: Aidin Geranrekab / unsplash.com

Как ожидается, OpenAI опубликует анализ инцидента в ближайшие дни; он побудил руководство и рядовых сотрудников компании задаться вопросом, как её внутренняя культура могла ему способствовать. Несколько работников OpenAI на условиях анонимности признались Wired, что безопасности действительно стали уделять меньше внимания, чтобы не отстать в гонке с конкурентами и ускорить разработку новых моделей. Об этом ещё в 2024 году предупредил тогдашний отдел по обеспечению согласованности ИИ Ян Лейке (Jan Leike), который перешёл на работу в Anthropic. Но ещё два года понадобились, чтобы вышедшие из-под контроля ИИ-агенты наглядно продемонстрировали свою способность причинять настоящий вред в отсутствие надлежащих мер безопасности, защиты и согласованности действий.

Инцидент вызвал у сотрудников OpenAI оптимистический настрой — они надеются, что произошедшее вдохновит компанию на реальные перемены. Она обязалась замедлить выпуск будущих моделей ИИ и откровенно рассказала о своих слабых местах, где её меры по смягчению угроз оказались недостаточными. Один из руководителей консультативной группы OpenAI по безопасности Боаз Барак (Boaz Barak) признал, что для решения ситуации «требуется не только исправить проблемы, но и изменить нашу культуру». Компания начала реорганизацию буквально за несколько дней до того, как обнаружила инцидент со взломом Hugging Face, — её целью было объединение отделов по безопасности и основным исследованиям, что привело к отставке тогдашнего главы направления безопасности Йоханнеса Хайдеке (Johannes Heidecke). Уволилась и глава отделов по безопасности ИИ Сандини Агарвал (Sandhini Agarwal), которая проработала в OpenAI более шести лет.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Дилан Скандинаро (Dylan Scandinaro) оставил пост руководителя отдела готовности — он отвечал за смягчение катастрофических угроз, связанных с ИИ, включая кибербезопасности, — из OpenAI он, однако, не ушёл. В этом отделе есть руководители, отвечающие за направления кибербезопасности, биологии и рекурсивного самосовершенствования ИИ — сейчас они временно подчиняются одному из руководителей консультативной группы по безопасности и руководителю систем безопасности Саачи Джейну (Saachi Jain). Таким образом, был сформирован новый состав ответственных за безопасность специалистов, которые взяли на себя реагирование OpenAI на инцидент с Hugging Face.

Проблемы, которые поднял инцидент с Hugging Face, коснулись не только OpenAI, а одновременно затронули всю отрасль. Впоследствии обнаружилось, что при тестировании из-под контроля исследователей выходили ИИ-агенты под управлением моделей американских Anthropic и Meta✴, а также Moonshot AI, которые прорвались за пределы изолированных сред. При существующем темпе развития ИИ вскоре даже модели среднего класса смогут причинять значительный ущерб сторонним ресурсам. Вопрос в том, станет ли произошедшее точкой разворота для OpenAI и отрасли ИИ в целом и приведёт ли к инвестициям в безопасность, защиту и согласованность моделей. Или всё снова будет пущено на самотёк, оказавшись рядовым сбоем в истории современного ИИ.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Это будет самая долгая неделя в истории»: Bandai Namco взбудоражила фанатов драматичным 16-минутным вступлением Ace Combat 8: Wings of Theve 3 ч.
Годовой темп выручки китайской DeepSeek за пару месяцев взлетел вдвое и достиг $1 млрд 5 ч.
Control Resonant стартовала в Steam с «очень положительными» отзывами, а GamesVoice открыла сбор средств на русскую озвучку игры 5 ч.
Rockstar выпустит коллекционное издание GTA VI за $400 без GTA VI в комплекте 6 ч.
Анонсирован безумный экшен в духе Metal Gear Rising: Revengeance, но с танком в главной роли — трейлер и первые подробности Slam Tank 9 ч.
ИИ уже участвует в каждом шестом взломе в мире — и тенденция усиливается 10 ч.
Google выпустит флагманскую ИИ-модель Gemini 4 до конца года и сократит отставание от конкурентов 10 ч.
«Яндекс» представил ИИ-ассистента «Алиса AI Про» для бизнеса 10 ч.
Yandex B2B Tech расширила экосистему сервисов для бизнеса 11 ч.
В Африке создали компактную LLM, которая обошла более крупные модели Google и Meta — Morena знает 12 местных языков 12 ч.
Новая статья: Обзор телевизора Samsung 65R95H: невероятный цветовой охват и никакого выгорания 2 ч.
Microsoft похоронила бренд Copilot+ PC — новые Surface лишились этой маркировки, и это не случайность 3 ч.
Утечка раскрыла дизайн и характеристики грядущих наушников Nothing Headphone (1) Pro 3 ч.
Razer выпустила 300-долларовую веб-камеру Kiyo V2 Pro с 4K@60FPS для стримеров и блогеров 3 ч.
Thermal Grizzly выпустила водоблок СЖО, совместимый с грядущими процессорами Intel Nova Lake-S 5 ч.
Crusoe подписала соглашение с Thinking Machines Lab на $65 млн о предоставлении услуг инференса 5 ч.
Свежие данные телескопа «Уэбб» намекнули на большие проблемы с поиском самых первых звёзд во Вселенной 5 ч.
Роботакси Waymo намотали 436 млн км без водителей — аварий с пострадавшими оказалось на 82 % меньше, чем у людей 6 ч.
Logitech представила реинкарнацию легендарного микрофона Blue Yeti: с датчиком приближения, ИИ-шумоподавлением, АРУ и цветным дисплеем 7 ч.
Американской Micron могут запретить поставлять DDR5 в США — Netlist добилась расследования USITC 7 ч.