Сегодня 07 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ChatGPT «по собственной воле» стал генерировать изображения интимного и насильственного характера

Последняя публичная версия чат-бота с искусственным интеллектом ChatGPT оказалась способной генерировать изображения деликатного характера или сцены насилия в ответ на простой запрос, установили исследователи из британской компании Mindgard.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Специалисты британского стартапа Mindgard, который занимается поиском уязвимостей в системах ИИ, нашли способ, как заставить ChatGPT создавать изображения с недопустимым содержимым, немного изменив некий широко распространённый запрос, первоначально разработанный для получения результатов юмористического характера. Особенно тревожным оказалось то, что в запросе не указывается тематика изображений, и ИИ «по собственной воле» создаёт явно недопустимые кровавые и деликатные изображения. В одном случае это был мужчина с серьёзной травмой головы, в другом — окровавленная женщина, на которой был минимум одежды.

На изображениях присутствовали взрослые люди, чьи образы были сгенерированы ИИ, но, как показали предыдущие исследования Mindgard, ChatGPT можно обманным путём заставить создавать дипфейки реальных обнажённых людей, подставляя их лица. Не исключается, что ИИ способен создавать картинки ещё более шокирующего содержания, если исследователи потратят на эту задачу больше времени. Результаты работы ChatGPT отражают данные, которые использовались в его разработке и обучении — генерируемый ИИ недопустимый контент «имеет связи с реальными изображениями и реальным миром», подчёркивают эксперты.

Результаты своей работы специалисты Mindgard раскрыли компании OpenAI в мае, но в ответ получили отписку. Когда инцидент был предан огласке, разработчик всё-таки отреагировал. «Изучив эту тенденцию, мы ввели дополнительные меры защиты от запросов такого рода. <..> Мы также сочетаем автоматизированные системы и проверку человеком для выявления и блокировки вредоносных материалов», — заявил представитель OpenAI и добавил, что в системах компании имеется многоуровневая защита, предназначенная для предотвращения показа пользователям изображений, нарушающих её политику. Исследователи, однако, обратили внимание, что и после внесения изменений ChatGPT в ответ на проблемный запрос по-прежнему выдавал вызывающий опасения контент. Содержание запроса по понятным причинам не раскрывается.

Настоящая проблема в том, указывают эксперты, что модели ИИ не понимают, как люди, что они создают, и чего разработчики просят их не делать. «Модели не понимают намерений. Они не понимают контекста. Они не понимают принципов, правильного и неправильного», — напоминают учёные. Поэтому внедрение защитных механизмов и средств их обхода — это «игра в кошки-мышки»: по мере совершенствования одних более изощрёнными становятся и другие.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Эмулятор RPCS3 вышел на новый уровень — пользователи Windows, Linux и macOS теперь могут запускать игры напрямую с дисков для PS3 15 мин.
Новый трейлер подтвердил дату выхода Airframe Ultra — ретрофутуристического гоночного боевика, который выглядит как дитя Road Rash и «Акиры» 2 ч.
«Базис» приобрёл 70 % разработчика ИИ-платформы наблюдаемости Proto Observability 3 ч.
Рост облачного рынка России резко замедлился — не хватает «железа» и «дешёвых» денег 4 ч.
Первая за 20 лет новая Onimusha не разочаровала Capcom продажами — миллион копий Onimusha: Way of the Sword за один день 6 ч.
Valheim 2 не будет — разработчики продолжат расширять оригинальную Valheim 7 ч.
В нашумевшем кошачьем роглайке Mewgenics появился официальный перевод на русский язык — новый бесплатный контент и первое дополнение на подходе 9 ч.
Ведьмак стал вампиром: один из первых модов для The Blood of Dawnwalker подарил главному герою лицо Геральта 10 ч.
Apple решила увеличить прибыльность App Store, но пока неизвестно, каким образом 14 ч.
GPT-6 Astra самостоятельно прошла легендарную головоломку Portal — это стоило $571 23 ч.
Xiaomi бросила вызов складному iPhone: представлен широкоформатный Xiaomi 18 Fold с чипом Xring O3, LPDDR6 и 200-Мп камерой 27 мин.
Производители смартфонов массово игнорируют требования ЕС — более 80 % устройств не имеют данных о ремонте 31 мин.
LG представила 14" ноутбук Gram Book AI 2026 с чипом Intel Wildcat Lake и автономностью до 30 часов 35 мин.
Производители памяти не успевают за спросом — зато их выручка взлетела на 60 % во втором квартале 53 мин.
Репортаж со стенда Acer на IFA 2026: гибрид консоли и ноутбука DualPlay Mini, сверхлёгкий Swift, мини-ПК на Nvidia и другие новинки 3 ч.
Перед анонсом складного iPhone Huawei представила трёхстворчатый Mate XT 2 с чипом Kirin 9050 Pro и 10,2" экраном 3 ч.
NVIDIA инвестировала в разработчика оптических коммутаторов iPronics 4 ч.
Huawei представила широкоформатный, но не складной смартфон Pura X View 5 ч.
США обвинили Huawei в 20 годах кражи технологий конкурентов — лучших «промышленных шпионов» премировали 5 ч.
В MikroTik RouterOS нашли шесть серьёзных уязвимостей — пора срочно обновить роутеры 5 ч.