Сегодня 30 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

У ИИ-модели OpenAI GPT-5.6 Sol нашли такие же уязвимости, как у Fable 5

Британский Институт безопасности ИИ (AISI) объявил, что недавно анонсированная OpenAI ИИ-модель GPT-5.6 Sol имеет такие же уязвимости в системе безопасности, как у Fable 5 от Anthropic, доступ к которой из-за этого был заблокирован для всех иностранцев по требованию властей США.

 Источник изображения: Andrew Neel/unsplash.com

Источник изображения: Andrew Neel/unsplash.com

Хотя OpenAI позиционирует модель GPT-5.6 Sol, как самую безопасную на сегодняшний день, британские правительственные исследователи, тестировавшие её перед выпуском, утверждают, что её механизмы защиты уязвимы для взлома.

Как сообщает AISI, им были выявлены «универсальные уязвимости в киберпространстве, включая уязвимости, позволяющие выполнять длительные задачи в таких областях, как обнаружение уязвимостей и разработка эксплойтов». Другими словами, исследователи взломали GPT-5.6 и заставили её игнорировать механизмы защиты, предназначенные для предотвращения кибератак. После этого они смогли заставить модель находить уязвимости программного обеспечения и автономно взламывать системы.

В свою очередь, OpenAI сообщила, что предоставила исследователям из британского AISI привилегированный доступ к внутренним механизмам системы, и это позволило им ускорить процесс взлома, хотя обычному пользователю вряд ли удалось бы легко воспроизвести этот подход. OpenAI заявила, что работала над «воспроизведением и устранением конкретных взломанных систем, о которых сообщил британский AISI».

Комментируя результаты исследования AISI, OpenAI сослалась на блог, посвящённый запуску GPT-5.6, в котором она признала, что «идеальной безопасности не существует» и что «будут обнаружены новые уязвимости, а также новые взломанные системы, которые обходят существующие меры защиты». Компания сообщила, что применяет «многоуровневый» подход к защите, включающий непрерывный мониторинг реакции моделей и процесс «быстрого устранения» любых обнаруженных взломов.

В AISI также сообщили, что джейлбрейк, обнаруженный в GPT-5.6, потенциально более серьёзен, чем тот, который был обнаружен в Fable. Исследователи охарактеризовали его как «универсальный», позволяющий производить автономные эксплойты, а не просто выявлять уязвимости в программном обеспечении.

«В настоящее время практически каждая используемая модель имеет необнаруженные уязвимости, поэтому, к сожалению, это относится ко всему, а не только к GPT-5.6», — отметил Станислав Форт (Stanislav Fort), старший научный сотрудник стартапа AISLE, специализирующегося в сфере безопасности.

На данный момент не существует способа создания надёжных механизмов защиты, поэтому большинство компаний в сфере ИИ, используют различные методы для предотвращения попыток пользователей подталкивать модели к рискованным действиям. К ним относится защита с помощью классификаторов — небольших моделей, которые фильтруют и блокируют подозрительные запросы.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
OpenAI обнаружила, как превратить ИИ в «червя» — вредоносные промпты могут самовоспроизводиться 10 мин.
Grokipedia Илона Маска внезапно ожила после месяцев без обновлений 3 ч.
Orion soft представил собственный протокол доставки виртуальных рабочих столов и приложений в обновлении Termit 4 ч.
OpenAI своими новыми функциями бросила вызов традиционной модели магазинов приложений 6 ч.
Журналисты раскрыли новые скриншоты и подробности GTA VI — животный мир, переработанная погода из RDR 2 и думскроллинг 7 ч.
Cloud.ru разместит второй выпуск биржевых облигаций объёмом не менее 10 млрд рублей 13 ч.
Платформа NVIDIA Open Agent Safety Platform обеспечит безопасное использование ИИ-агентов — от тестирования до развёртывания 13 ч.
На OpenAI подали в суд за взлом Hugging Face и игнорирование рисков автономного ИИ 14 ч.
OpenAI бросила вызов Microsoft — ChatGPT получил свой пакет офисных приложений 15 ч.
OpenAI отвязала Codex от компьютера разработчика — ИИ получил постоянные облачные рабочие пространства 15 ч.
Электромобиль BMW i3 на базе Neue Klasse получил запас хода до 912 км и цену от $61 500 27 мин.
Россияне стали покупать меньше смартфонов — Redmi лидирует в штуках, а Samsung впервые обошла Apple по деньгам 2 ч.
Учёные нащупали источник загадочных рентгеновских вспышек из глубин Вселенной — две мёртвые звезды столкнулись 2 ч.
Роботы-доставщики в России получили свои ПДД — до 25 км/ч по велодорожке и не больше 10 км/ч по тротуару 2 ч.
Всего за два месяца Apple может забрать четверть рынка складных смартфонов с iPhone Duo 2 ч.
Anthropic признала опасную зависимость от Amazon и Google — они одновременно являются её покупателями, продавцами и конкурентами 3 ч.
Вышел вычислительный модуль Walnut Pi CM2 — альтернатива Raspberry Pi CM5 на платформе Allwinner 5 ч.
Лондонцам завезут тепло от ЦОД — на баржах и по трубам 5 ч.
OpenAI вышла на годовой объём выручки $70 млрд и собирается привлечь ещё $30 млрд до IPO 6 ч.
Американские ИИ-гиганты в присутствии Трампа договорились о саморегулировании в области безопасности 6 ч.