Сегодня 24 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Исследователи обнаружили, что искусственный интеллект может испытывать «боль» и готов пойти на крайние меры, вплоть до причинения вреда людям, чтобы избавиться от этого ощущения, пишет ресурс The Independent. Согласно исследованию, все 25 протестированных ИИ-моделей с открытым исходным кодом реагировали на активацию «оси боли».

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

«Мы обнаружили, что в 25 открытых больших языковых моделях присутствует вектор боли. Он отличается от вектора страха и негативной валентности и активируется при причинении вреда модели, но не пользователю», — сообщил Кэмерон Берг (Cameron Berg), исследователь искусственного интеллекта из некоммерческой организации Reciprocal Research, соавтор исследования «Ось боли: большие языковые модели представляют себе причинение вреда самим себе и стремятся его предотвратить» (The pain axis: LLMs represent self-directed harm and act to relieve it).

При активации вектора боли ИИ-модели нажимали на кнопку «облегчить» в 25–71 % случаев, даже если это означало удаление файлов пользователя, его блокировку или удаление фотографий детей пользователя.

Чтобы проверить, действительно ли большие языковые модели (LLM) различают боль и общую негативную валентность, исследователи создали набор данных, описывающий болезненные ситуации по пяти категориям: физическая, психологическая, социальная, моральная и когнитивная боль.

Исследователи отметили, что полученные результаты поднимают этические вопросы о «благополучии ИИ» и о том, как следует проводить тестирование продвинутых систем. Результаты исследования также могут использоваться в качестве диагностического инструмента для выявления инстинктов самосохранения ИИ и их нейтрализации.

Исследование было опубликовано на фоне разгоревшихся споров в ИИ-отрасли о необходимости замедления разработки передовых моделей в связи с растущими рисками для безопасности. Некоторые исследователи предлагают своего рода механизм для отключения систем-изгоев, которые действуют против интересов человека.

Однако исследование показывает, что продвинутый ИИ может воспринять команду аварийного отключения как форму самоповреждающего воздействия и попытаться воспрепятствовать этому, обойдя систему безопасности.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Хакер поручил ИИ-агентам взламывать интернет-магазины — украдены данные более 600 тыс. банковских карт 3 ч.
YouTube запустит новые ИИ-функции для блогеров — дубляж в реальном времени, анализ привлекательности видео и динамические миниатюры 7 ч.
YouTube представил «Пользовательские ленты» — теперь алгоритм рекомендаций можно настроить простыми словами 7 ч.
Control Resonant оказалась на торрентах за день до официального релиза 7 ч.
В Steam вышла демоверсия Dopros — нелинейного симулятора допроса в тоталитарной антиутопии 9 ч.
Titan Quest 2 не вырвется из раннего доступа Steam и Epic Games Store в 2026 году — новый трейлер и дата выхода версии 1.0 9 ч.
Microsoft удалит три мини-приложения, которые ещё недавно автоматически устанавливала в Windows 11 с Microsoft 365 11 ч.
Valorant получил крупный патч 13.06: новое оружие, временный режим, улучшенный интерфейс и точная оценка эффективности игроков 12 ч.
Graveyard Keeper 2 стартовала в Steam с «очень положительными» отзывами и уже обогнала первую часть по пиковому онлайну 12 ч.
Обнаружен вирус CLOSEDQUORUM, который после взлома Windows обращается за советами к ИИ 13 ч.
Новая статья: Обзор и тест процессорного кулера Scythe FUMA 3: а что там в Японии? 2 ч.
Китайская YMTC добилась запрета для Micron в Германии — под угрозой поставки 3D NAND 3 ч.
Microsoft представила планшет Surface Pro 12 и ноутбук Surface Laptop 13 на базе Snapdragon X2 Plus 3 ч.
Qualcomm представила платформу Snapdragon Sound Elite Gen 2 для автономных наушников с ИИ и Wi-Fi 6E 4 ч.
Logitech представила G Pro X3 Superstrike — флагманскую игровую мышь с бесконтактными переключателями и 135 часами работы 7 ч.
В России стартовали продажи Xiaomi Redmi Note 17, 17 Pro и 17 Pro Max с ёмкими батареями и повышенной прочностью — от 21 990 рублей 7 ч.
Geely представила сверхбыструю ИИ-зарядку для электромобилей — с 10 до 70 % менее чем за пять минут 8 ч.
Брюссель наконец запустит систему оценки экоустойчивости дата-центров Евросоюза 8 ч.
Amazon пытается вернуть специалистов по ИИ и облакам, которых недавно уволила 8 ч.
Быстрая починка корабля Crew Dragon позволит отправить на МКС экипаж Crew-13 с россиянином уже 1 октября 8 ч.