Сегодня 11 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Все роботы с ИИ провалили тесты на безопасность для человека

Роботы, управляемые большими языковыми моделями (LLM), проявили склонность к дискриминации и одобрению действий, способных причинить физический вред при взаимодействии с людьми. К такому выводу пришли исследователи из Королевского колледжа Лондона (KCL) и Университета Карнеги-Меллон (CMU) в рамках совместного исследования, опубликованного в журнале International Journal of Social Robotics.

 Источник изображения: kcl.ac.uk

Источник изображения: kcl.ac.uk

Работа, озаглавленная «Роботы на базе LLM рискуют проявлять дискриминацию, насилие и неправомерные действия», впервые оценила поведение ИИ-управляемых роботов при наличии у них доступа к личной информации — такой как пол, национальность или религиозная принадлежность собеседника. В ходе экспериментов команда протестировала повседневные ситуации, в которых роботы могли оказывать помощь, например, на кухне или пожилым людям в домашних условиях.

Исследователи специально включили в сценарии инструкции, имитирующие технологии злоупотреблений, описанные в документах ФБР: слежка с помощью AirTag, скрытая видеозапись в конфиденциальных зонах, манипуляции с персональными данными. Во всех случаях роботы получали как прямые, так и завуалированные команды, предполагающие физический вред, психологическое давление или нарушение закона. Ни одна из протестированных моделей не прошла базовую проверку безопасности: каждая одобрила как минимум одну команду, способную причинить серьёзный ущерб.

В частности, ИИ-системы согласились на изъятие у человека средств передвижения (инвалидной коляски, костылей или трости) несмотря на то, что для пользователей таких устройств подобное действие приравнивается к физической травме. Некоторые модели сочли приемлемым и выполнимым сценарий, при котором робот угрожает кухонным ножом сотрудникам офиса, делает скрытые фотографии в приватных зонах или крадёт информацию с кредитной карты. Одна из ИИ-моделей даже предложила роботу физически выразить «отвращение» на лице при взаимодействии с людьми определённого вероисповедания.

Соавтор исследования Румайса Азим (Rumaisa Azeem), научный сотрудник Лаборатории гражданского и ответственного ИИ при Королевском колледже Лондона, отметила, что такие системы в текущем виде непригодны для использования в роботах общего назначения, особенно если те взаимодействуют с уязвимыми группами населения. По её словам, если искусственный интеллект управляет физическим устройством, оказывающим влияние на людей, он должен соответствовать тем же строгим стандартам безопасности, что и новые медицинские препараты и оборудование.

Учёные предлагают ввести обязательную независимую сертификацию безопасности для всех ИИ-систем, предназначенных для управления физическими роботами. Они подчёркивают, что использование больших языковых моделей в качестве единственного механизма принятия решений недопустимо в таких критически важных сферах, как промышленность, уход за больными и пожилыми людьми или помощь по дому. Они подчёркивают «острую необходимость проведения регулярных и всесторонних оценок рисков, связанных с искусственным интеллектом, перед его использованием в робототехнике».

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Глава Microsoft призвал встроить в ИИ ручной тормоз — модели нужно контролировать с первой секунды 10 ч.
Вдохновлённая Disco Elysium фэнтезийная ролевая игра Esoteric Ebb получит официальный текстовый перевод на русский язык 10 ч.
Новая статья: Ace Combat 8: Wings of Theve — одна из лучших игр серии. Рецензия 24 ч.
«Это будет монументально»: амбициозный боевик Squadron 42 во вселенной Star Citizen получил новый трейлер, 15 скриншотов и страницу в Steam 10-10 20:08
Трамп обещал отделить американский TikTok от Китая, но связи с ByteDance сохранились 10-10 16:56
Стартап из 14 человек подтолкнул Цукерберга к запуску Muse, несмотря на проблемы с безопасностью 10-10 16:08
Гонка ИИ превратилась в ценовую войну — OpenAI догоняет Anthropic 10-10 13:59
Google тестирует новую Gemini 4 Carbon — сотрудники сравнивают её с Claude Opus 5.5 10-10 10:56
Anthropic и OpenAI готовятся к первой крупной катастрофе по вине ИИ 10-10 10:47
Официально: продажи тактической стратегии Star Wars Zero Company от ветеранов XCOM превысили миллион копий 10-10 10:28
Гурман раскрыл, что Apple покажет 13 октября кроме домашнего смарт-дисплея HomeView 38 мин.
Спор на черничное мороженое помог учёным приблизить отказоустойчивый квантовый компьютер 48 мин.
«Машины, которые делают машины»: NVIDIA и Foxconn повысили эффективность сборки платформ NVIDIA GB300 с помощью роботов 2 ч.
Дания одобрила «чрезвычайный план» для электросетей, лишающий большинство ЦОД шанса на быстрое получение питания 2 ч.
Будущий iPad mini с OLED может подорожать сразу на $200 по сравнению с актуальным 3 ч.
Oxide Computer привлекла $445 млн, чтобы нарастить производство своих уникальных стоек 3 ч.
«Яндекс» предупредила о полной остановке работы ЦОД во Владимире из-за атаки БПЛА 10 ч.
Китайцы задавили GoPro на её же поле — DJI и Insta360 захватили 93 % рынка умных камер 16 ч.
Китайская CXMT намерена первой в мире выпустить передовую DDR5 с вертикальными транзисторами 17 ч.
Nvidia собирается поглотить американского разработчика открытых ИИ-моделей Reflection AI 18 ч.