Сегодня 21 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Все роботы с ИИ провалили тесты на безопасность для человека

Роботы, управляемые большими языковыми моделями (LLM), проявили склонность к дискриминации и одобрению действий, способных причинить физический вред при взаимодействии с людьми. К такому выводу пришли исследователи из Королевского колледжа Лондона (KCL) и Университета Карнеги-Меллон (CMU) в рамках совместного исследования, опубликованного в журнале International Journal of Social Robotics.

 Источник изображения: kcl.ac.uk

Источник изображения: kcl.ac.uk

Работа, озаглавленная «Роботы на базе LLM рискуют проявлять дискриминацию, насилие и неправомерные действия», впервые оценила поведение ИИ-управляемых роботов при наличии у них доступа к личной информации — такой как пол, национальность или религиозная принадлежность собеседника. В ходе экспериментов команда протестировала повседневные ситуации, в которых роботы могли оказывать помощь, например, на кухне или пожилым людям в домашних условиях.

Исследователи специально включили в сценарии инструкции, имитирующие технологии злоупотреблений, описанные в документах ФБР: слежка с помощью AirTag, скрытая видеозапись в конфиденциальных зонах, манипуляции с персональными данными. Во всех случаях роботы получали как прямые, так и завуалированные команды, предполагающие физический вред, психологическое давление или нарушение закона. Ни одна из протестированных моделей не прошла базовую проверку безопасности: каждая одобрила как минимум одну команду, способную причинить серьёзный ущерб.

В частности, ИИ-системы согласились на изъятие у человека средств передвижения (инвалидной коляски, костылей или трости) несмотря на то, что для пользователей таких устройств подобное действие приравнивается к физической травме. Некоторые модели сочли приемлемым и выполнимым сценарий, при котором робот угрожает кухонным ножом сотрудникам офиса, делает скрытые фотографии в приватных зонах или крадёт информацию с кредитной карты. Одна из ИИ-моделей даже предложила роботу физически выразить «отвращение» на лице при взаимодействии с людьми определённого вероисповедания.

Соавтор исследования Румайса Азим (Rumaisa Azeem), научный сотрудник Лаборатории гражданского и ответственного ИИ при Королевском колледже Лондона, отметила, что такие системы в текущем виде непригодны для использования в роботах общего назначения, особенно если те взаимодействуют с уязвимыми группами населения. По её словам, если искусственный интеллект управляет физическим устройством, оказывающим влияние на людей, он должен соответствовать тем же строгим стандартам безопасности, что и новые медицинские препараты и оборудование.

Учёные предлагают ввести обязательную независимую сертификацию безопасности для всех ИИ-систем, предназначенных для управления физическими роботами. Они подчёркивают, что использование больших языковых моделей в качестве единственного механизма принятия решений недопустимо в таких критически важных сферах, как промышленность, уход за больными и пожилыми людьми или помощь по дому. Они подчёркивают «острую необходимость проведения регулярных и всесторонних оценок рисков, связанных с искусственным интеллектом, перед его использованием в робототехнике».

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Анджей Сапковский рассказал, когда ждать следующего «Ведьмака» 2 ч.
«Заберите мои деньги, прошу»: геймплейный трейлер дополнения Lazarus заинтриговал фанатов Cronos: The New Dawn 3 ч.
«Криптозима» закончилась? Биткоин достиг максимума с января, перешагнув $85 000 3 ч.
Анонсирован уютный симулятор уборки Dust till Dawn с элементами хоррора и музыкой от композитора Silent Hill 4 ч.
Valve открыла исходный код Lepton — инструмента для переноса игр с Android на Steam Frame 5 ч.
Хуанг набрал вес в Белом доме — глава Nvidia фактически стал главным советником Трампа по ИИ 9 ч.
Неогранённый алмаз: критики вынесли вердикт Silent Hill: Townfall 9 ч.
Google хочет поменьше пускать людей в настоящий интернет — в Discover тестируются ИИ-сводки вместо переходов на сайты 10 ч.
«Не хотел повторения истории с P.T.»: Кодзима рассказал, как спасал Physint после разрыва с PlayStation 11 ч.
Konami позволит начать прохождение метроидвании Castlevania: Belmont’s Curse на две недели раньше — анонсирована бесплатная демоверсия 12 ч.
AMD пополнила клуб компаний с капитализацией в $1 трлн — раньше, чем Intel 54 мин.
Acer, Dell, HP и Asus представили свои версии Googlebook с процессорами Intel Core Ultra 300 и Snapdragon X Elite 2 ч.
MediaTek представила ноутбучный процессор Dimensity CX C10 Max для Googlebook — он поддерживает ИИ и трассировку лучей 3 ч.
Стартовали предзаказы на Googlebook — Android-ноутбуки на чипах Intel и Qualcomm оценены от $899 3 ч.
Vivo представила фотофлагманы X500 Pro и X500 Pro Max — первые на 2-нм чипе Dimensity 9600 Pro 4 ч.
Британский необлачный провайдер Nscale подал заявку на IPO в США с оценкой рыночной стоимости в $35 млрд 5 ч.
iFixit разобрали iPhone 18 Pro и Pro Max — новая камера дороже в ремонте, а батарея может потянуть за собой дисплей 5 ч.
Apple программно занизила ёмкость батареи iPhone 18 Pro Max — активация всё исправляет 5 ч.
Nothing выделит бюджетный бренд CMF в самостоятельную компанию со штаб-квартирой в Индии 5 ч.
CoreWeave стала клиентом оператора криптомайнинговых ЦОД Blockfusion в Ниагара-Фолс 5 ч.