Сегодня 01 июля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Учёные разработали ИИ-чат-бот, который эффективно взламывает других ИИ-чат-ботов

Учёные-компьютерщики из Наньянского технологического университета (NTU, Сингапур) нашли эффективный способ взлома чат-ботов с искусственным интеллектом (ИИ). Для этого они обучают ИИ-чат-бот созданию подсказок, которые позволяют обходить защиту других чат-ботов на базе ИИ.

 Источник изображения: NTU

Источник изображения: NTU

Сингапурские исследователи использовали двойной метод взлома большой языковой модели (LLM), получивший название Masterkey. Во-первых, они провели реверс-инжиниринг того, как LLM выявляют вредоносные запросы и защищаются от них. Используя эту информацию, они научили LLM автоматически учиться и предлагать подсказки, которые позволяют обходить защиту других LLM. Таким образом можно создать LLM для взлома, которая сможет автоматически адаптироваться к новым условиям и создавать новые запросы для взлома после того, как разработчики внесут исправления в свои LLM.

После проведения серии тестов на LLM в качестве доказательства, что этот метод действительно представляет реальную угрозу, исследователи сразу же известили о выявленных проблемах провайдеров сервисов после успешного взлома их ИИ-моделей.

Разработка учёных NTU должна помочь компаниям определить слабые стороны и ограничения своих ИИ-чат-ботов, чтобы принять меры по их защите от хакеров.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Nvidia подтвердила, что скоро прекратит выпускать драйверы для видеокарт GeForce GTX 700, 900 и 1000 2 ч.
Будущее Halo прояснится в октябре, и фанаты «не захотят пропускать» это 2 ч.
Запуски ракет NASA и работу астронавтов в открытом космосе начнут показывать на Netflix 2 ч.
Siri может поумнеть с помощью ИИ OpenAI или Anthropic — у Apple не получается обучить достойный ИИ самостоятельно 2 ч.
Warhammer 40,000: Space Marine 2 продолжит получать новый контент — подробности крупного обновления 10.0 2 ч.
«Яндекс» открыл бесплатный доступ к своей лучшей нейросети YandexGPT 5 Pro через «Чат с Алисой» 3 ч.
Стартапу xAI Илона Маска удалось недавно привлечь в общей сложности $10 млрд 6 ч.
Руководство OpenAI признало, что конкуренция за ценные кадры вынуждает его шевелиться 10 ч.
Марк Цукерберг собрал звёздную команду для разработки суперинтеллекта 11 ч.
Microsoft испытала ИИ-доктора MAI-DxO, который ставит диагнозы в 4 раза точнее врачей 15 ч.
Xiaomi распродала все электромобили YU7 на год вперёд — и вызвала гнев сотен покупателей 14 мин.
Обновление системы резервного копирования TATLIN.BACKUP для защиты данных от вирусов-шифровальщиков 17 мин.
HPE продаст Instant On, чтобы купить Juniper, а Juniper лицензирует Mist, чтобы продаться HPE 19 мин.
В России запретят называть отечественными чипы, произведённые за границей — статус Baikal и «Эльбрус» под угрозой 2 ч.
Xiaomi задействовала 1000 роботов и передовые технологии для сборки электромобилей 2 ч.
Google договорилась о покупке термоядерной энергии у детища MIT — Commonwealth Fusion Systems 3 ч.
Россияне стали чаще покупать ноутбуки без операционной системы — так дешевле 3 ч.
Blue Origin в 13-й раз свозила туристов на границу космоса — и 1000 открыток в придачу 3 ч.
Amazon запустила инстансы EC2 C8gn с чипами Graviton4 для требовательных сетевых нагрузок 3 ч.
Вышел модуль Raspberry Pi Radio Module 2 с поддержкой Wi-Fi 4 за $4 3 ч.