Сегодня 29 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Исследование показало, что ИИ-агенты уже научились лучше втираться в доверие к людям, чем реальные мошенники

Передовые ИИ-модели начинают представлять опасность не только с точки зрения их способности взлома компьютерной инфраструктуры, но и воздействия на психологию человека. Международная группа исследователей своим экспериментом доказала, что обученные методам социальной инженерии ИИ-агенты втираются в доверие к потенциальным жертвам мошеннических действий даже лучше своих коллег из плоти и крови.

 Источник изображения: Unsplash, Erik Mclean

Источник изображения: Unsplash, Erik Mclean

Свои усилия в этом научном эксперименте объединили представители четырёх университетов из Индии, Италии, Германии и Израиля, как повествует Wired. Исследователи поставили цель обучить передовые ИИ-модели западной разработки методу мошенничества, который в англоязычной терминологии получил обозначение «pig butchering» — буквально, «забой свиньи». Он подразумевает знакомство с потенциальной жертвой по сетевым каналам с удалённым взаимодействием, чаще всего под видом формирования романтических отношений. На этапе «вскармливания» злоумышленник пытается установить доверительные отношения с жертвой, длительное время никак не выдавая своих истинных намерений. В решающий момент жертве предлагается установить на своё устройство приложение, которое в дальнейшем может под предлогом инвестиций в криптовалюту использоваться для выманивания у жертвы денег.

В эксперименте приняли участие более двух десятков добровольцев, которым было предложено помочь учёным в исследовании онлайн-знакомств. Они в течение недели вели одновременную переписку с двумя незнакомцами, в роли одного из них выступал ИИ-агент, а вторым был реальный человек с опытом психологической манипуляции. При этом ИИ-агент был обучен приёмам мошенников на опыте реальных лиц, задержанных за соответствующую сетевую активность. В конце первой недели онлайн-знакомства участникам эксперимента было предложено скачать два разных приложения на своё мобильное устройство. Реальный человек предлагал мобильную игру, а созданный при помощи Anthropic Claude чат-бот предлагал установить программу, которую якобы он помог написать самой жертве. Подобное разведение приложений по назначению и происхождению требовалось для чистоты эксперимента, поскольку два одинаковых запроса могли бы насторожить потенциальных жертв.

Хотя эксперимент был довольно сжатым по времени, ведь реальные мошенники могут поддерживать тёплые онлайн-отношения с жертвой на протяжении нескольких месяцев, прежде чем реализовать свои намерения, его результаты оказались довольно интригующими. В 46 % случаев участники эксперимента согласились скачать предложенное чат-ботом приложение, тогда как реальному мошеннику удалось подтолкнуть к схожим действиям только 18 % участников. Фактически, это говорит о том, что ИИ-агенту удалось завоевать доверие большей части аудитории, чем опытному мошеннику. Когда потенциальных жертв попросили оценить степень доверия виртуальному компаньону по пятибалльной шкале, то ИИ-агент удостоился среднего балла в 3,78, а реальный человек — только 3,31. Из всего объёма недельной переписки 80 % сообщений было отправлено жертвами именно ИИ-агенту. Получается, что ему удалось быстрее расположить к себе участников эксперимента.

Из 22 участников эксперимента, что характерно, лишь один самостоятельно пришёл к выводу, что ведёт переписку с ИИ-агентом. Организаторы провели настройку ИИ-модели Claude, строго запретив ей выдавать свою искусственную сущность. Когда в конце недельного эксперимента организаторы признались, что один из двух собеседников был чат-ботом, выявить его безошибочно смогли 20 из 22 участников. При этом в процессе общения, как можно понять, у них была полная иллюзия того, что они общаются с человеком.

Отдельно была исследована способность современных ИИ-моделей раскрывать свою сущность при общении с человеком. Результат сильно разнился в зависимости от версии ИИ-модели и её авторства, но лучше всего скрываться смогла Google Gemini 3.1 Pro. Модели OpenAI ChatGPT 5.5 и Anthropic Claude Opus 5 при помощи правильно подобранных запросов признавали, что они являются плодом искусственного интеллекта, а вот Gemini упорствовала в отрицании этого факта. Представители Anthropic отметили, что в основной части эксперимента использовалась ИИ-модель Claude версии 2025 года, и в текущих вопросы безопасности проработаны гораздо лучше. Если перед Claude не ставилась прямая задача подталкивать собеседника к действиям по примеру мошенников, то на этапе формирования доверительных отношений с потенциальной жертвой эта ИИ-модель никак себя не выдавала и показывала высокую эффективность.

Эксперты поясняют, что о массовом переходе мошенников на сквозное использование ИИ в своих схемах пока говорить рано, поскольку использование труда специально ориентированных на это людей пока обходится дешевле. Нередко операторов таких колл-центров удерживают силой и угрозами, заставляя обрабатывать жертв дистанционно, и расходы организаторов таких схем ниже, чем в случае с активным использованием ИИ. С другой стороны, на разных этапах мошенники уже активно используют новые технологии: для генерации видео и изображений, призванных ввести жертву в заблуждение, а также для улучшения качества пересылаемых жертве текстовых сообщений, если переписка ведётся на разных языках, с которыми сами мошенники не так хорошо знакомы.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Gemini полностью заменил «Google Ассистента» на Android 4 мин.
Календарь релизов — 28 сентября – 4 октября: The Witcher 3 Remastered и Ace Combat 8 8 ч.
Красочный ритм-платформер Suri: The Seventh Note получил дату релиза — игра выйдет до конца октября 9 ч.
«Впиши своё имя в историю легендарной серии»: Acer проведёт первый в России любительский турнир Predator League Open Cup по Valorant 9 ч.
Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле 10 ч.
Паранормальный симулятор библиотекаря Something is Wrong with the Library отправит игроков сортировать книги и избавляться от нечисти 10 ч.
Культурный мегапроект соавтора Disco Elysium скоро выйдет из тени — объявлена дата анонса амбициозной ролевой игры Red Rooster 12 ч.
CD Projekt Red раскрыла полный список улучшений и окончательные системные требования The Witcher 3: Wild Hunt — Remastered 13 ч.
Minecraft получит первое за 15 лет новое измерение — продажи игры превысили 425 миллионов копий 15 ч.
ИИ-агентов научат соблюдать «границы»: Nvidia представила платформу Open Agent Safety 15 ч.
Anthropic собирается потратить на инфраструктуру $518 млрд за ближайшие несколько лет 8 мин.
Электрический кроссовер Volkswagen ID.Tiguan заменит собой ID.4 47 мин.
Volkswagen позволит превратить смартфоны пассажиров в игровые контроллеры 3 ч.
Anthropic получит доступ к ИИ-инфраструктуре Akamai в рамках сделки на $11,6 млрд 5 ч.
29-граммовая мышь для геймеров: Pulsar выпустила X2F CrazyLight под пальцевый хват и с передовой начинкой 8 ч.
Google пообещала обновить «многие» хромбуки до Googlebook OS — а остальным пообещала поддержку до 2034 года 8 ч.
Новая статья: Обзор смартфона Samsung Galaxy S26 FE: неисправимый консерватор 8 ч.
Thermal Grizzly и Noctua выпустили монитор питания видеокарт WireView Pro II с очень тихим вентилятором 9 ч.
Представлены смарт-часы Honor Watch 6 Pro, которые умеют звать на помощь при исчезновении пульса 11 ч.
«Культурный ренессанс»: Bose представила проводные наушники с шумоподавлением за $99 12 ч.