Сегодня 05 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ChatGPT «по собственной воле» стал генерировать изображения интимного и насильственного характера

Последняя публичная версия чат-бота с искусственным интеллектом ChatGPT оказалась способной генерировать изображения деликатного характера или сцены насилия в ответ на простой запрос, установили исследователи из британской компании Mindgard.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Специалисты британского стартапа Mindgard, который занимается поиском уязвимостей в системах ИИ, нашли способ, как заставить ChatGPT создавать изображения с недопустимым содержимым, немного изменив некий широко распространённый запрос, первоначально разработанный для получения результатов юмористического характера. Особенно тревожным оказалось то, что в запросе не указывается тематика изображений, и ИИ «по собственной воле» создаёт явно недопустимые кровавые и деликатные изображения. В одном случае это был мужчина с серьёзной травмой головы, в другом — окровавленная женщина, на которой был минимум одежды.

На изображениях присутствовали взрослые люди, чьи образы были сгенерированы ИИ, но, как показали предыдущие исследования Mindgard, ChatGPT можно обманным путём заставить создавать дипфейки реальных обнажённых людей, подставляя их лица. Не исключается, что ИИ способен создавать картинки ещё более шокирующего содержания, если исследователи потратят на эту задачу больше времени. Результаты работы ChatGPT отражают данные, которые использовались в его разработке и обучении — генерируемый ИИ недопустимый контент «имеет связи с реальными изображениями и реальным миром», подчёркивают эксперты.

Результаты своей работы специалисты Mindgard раскрыли компании OpenAI в мае, но в ответ получили отписку. Когда инцидент был предан огласке, разработчик всё-таки отреагировал. «Изучив эту тенденцию, мы ввели дополнительные меры защиты от запросов такого рода. <..> Мы также сочетаем автоматизированные системы и проверку человеком для выявления и блокировки вредоносных материалов», — заявил представитель OpenAI и добавил, что в системах компании имеется многоуровневая защита, предназначенная для предотвращения показа пользователям изображений, нарушающих её политику. Исследователи, однако, обратили внимание, что и после внесения изменений ChatGPT в ответ на проблемный запрос по-прежнему выдавал вызывающий опасения контент. Содержание запроса по понятным причинам не раскрывается.

Настоящая проблема в том, указывают эксперты, что модели ИИ не понимают, как люди, что они создают, и чего разработчики просят их не делать. «Модели не понимают намерений. Они не понимают контекста. Они не понимают принципов, правильного и неправильного», — напоминают учёные. Поэтому внедрение защитных механизмов и средств их обхода — это «игра в кошки-мышки»: по мере совершенствования одних более изощрёнными становятся и другие.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Эксперты Unit 42 выявили критические недостатки защиты ключей доступа в браузере Chrome 12 мин.
WhatsApp добавил тег оповещения @all и разрешил переносить участников из старых групп в новые 2 ч.
«Тантор Лабс» усилила позиции на рынке, приобретя СУБД «Персей» и её разработчиков 7 ч.
Разработчики Mafia: The Old Country показали геймплей сюжетного дополнения Man of Honor, в котором появится звезда первой «Мафии» 10 ч.
«Death Stranding 3»: кооперативное приключение Big Walk от авторов Untitled Goose Game очаровало игроков и критиков 11 ч.
Spotify не оправдала ожидания по прибыли и аудитории — акции просели 13 ч.
OpenAI назвала иск о похищении секретов Apple «безответственным, агрессивным и странно личным» 13 ч.
ИИ-агенты помогут создать аналоги CUDA, но Nvidia тоже не стоит на месте 13 ч.
Новые фракции, новые платформы и новая демоверсия: фэнтезийная 4X-стратегия Endless Legend 2 получила дату выхода из раннего доступа Steam 13 ч.
У Apple хотят отсудить более $30 млрд за распознавание лиц на фото 13 ч.
Раскрыты детали соглашения Anthropic на $10 млрд с новичком на рынке облачных вычислений 2 ч.
Выручка AMD на серверном направлении удвоилась, а общая взлетела в полтора раза 2 ч.
Samsung запустила в Южной Корее NPUaaS на базе ИИ-ускорителей FuriosaAI RNGD 6 ч.
Apple раскрыла дату презентации iPhone 18, но пока лишь сотрудникам 8 ч.
Не подлетай — опасно: угрожавший Земле астероид Апофис сам рискует пострадать от космического мусора 8 ч.
Gigabyte выпустила блок питания Aorus P1600W PCIe 5.1 AI TOP на 1600 Вт со встроенным ЖК-экраном 8 ч.
В России представили отечественный электронный коленный модуль с интеллектуальным управлением 12 ч.
Китайские астрономы обнаружили мощнейший во Вселенной ускоритель частиц — он в 4400 раз превосходит БАК 12 ч.
США намерены запретить использование китайских компонентов в американских дата-центрах 13 ч.
Qualcomm выпустила очередную версию Snapdragon 8 Elite Gen 5 — слегка урезанный Snapdragon 8 Elite Gen 5 V-series 13 ч.