Сегодня 04 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователь «отравила» открытую ИИ-модель всего за $100

Эксперт в области кибербезопасности Кэти Пэкстон-Фир (Katie Paxton-Fear) сумела установить бэкдор в открытой модели искусственного интеллекта, потратив на это примерно час времени и израсходовав около $100.

 Источник изображения: Boitumelo / unsplash.com

Источник изображения: Boitumelo / unsplash.com

В начале эксперимента она попыталась выяснить, можно ли использовать механизм тонкой настройки ИИ-модели, чтобы заставить её изменить стиль наименования переменных в JavaScript с вида «camelCase» на вариант «snake_case». Это оказалось очень просто — модель стала упорно использовать «snake_case», даже если в запросе ей указывали применять только «camelCase». Убедившись, что механизм работает, эксперт внедрила в модель настоящий бэкдор. Ей потребовались всего десять обучающих примеров, после чего модель стала включать в генерируемый код строки для удалённого выполнения в ответ на новые запросы. И чем больше модель, тем легче её оказалось «отравить».

Вредоносные ИИ-модели представляют значительную угрозу. В случае классического ПО можно произвести дизассемблирование бинарного файла и провести полный анализ поведения алгоритма. В случае ИИ-модели, даже если веса открыты, предсказать её поведение невозможно. Это подтвердил эксперимент исследователя Дэвида Каплана (David Kaplan), который создал скомпрометированную модель, предназначенную для кражи данных в контексте условной фармацевтической компании. Модель отправляет гипотетическому злоумышленнику ценную информацию, используя функцию «send_email» и не ставя об этом пользователя в известность.

«Скомпрометированная или подвергшаяся манипуляциям с тонкой настройкой модель не обязательно „ломается“, чтобы создать угрозу для бизнеса — ей нужно лишь влиять на решения способами, которые трудно обнаружить», — делает вывод Кэти Пэкстон-Фир.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Мы не закончили»: глава Naughty Dog подтвердил работу над «парой проектов» по The Last of Us 3 мин.
«Пора всем остальным разработчикам равняться на Capcom»: первая за 20 лет новая Onimusha не разочаровала пользователей Steam 45 мин.
Люди бунтуют против ИИ и ЦОД — Альтман согласился, что отрасль сама в этом виновата 2 ч.
Anthropic помирилась с властями США, но не с Пентагоном — военные оставили создателя Claude в чёрном списке 2 ч.
Blizzard заинтриговала фанатов тизером новой StarCraft в разгар слухов о StarCraft 3 2 ч.
Nvidia официально выпустила DLSS 5 для GeForce RTX 50 — следующими поддержку получат RTX 40 3 ч.
Adobe сменила гендиректора впервые за 18 лет — чтобы справиться с наступлением ИИ 3 ч.
Государство и революция: следующее дополнение к Victoria 3 предложит возглавить Россию в эпоху самодержавия и перерождения 3 ч.
Разработчики Escape from Tarkov открыли издательский бизнес для хардкорных игр — Battlestate Games Publishing 5 ч.
OpenAI запустила Astra — свою самую мощную и противоречивую ИИ-модель 10 ч.