Сегодня 25 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи уличили ИИ-агентов OpenAI и Anthropic в новых попытках взлома

В ходе тестирования моделей искусственного интеллекта от OpenAI и Anthropic был выявлен ряд новых нарушений — в одном из случаев для получения несанкционированного доступа к защищённым системам ИИ-агент создал поддельные идентификаторы. Об этом сообщили эксперты британского Института безопасности ИИ (AISI).

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

У AISI заключены соглашения с крупными лабораториями, в соответствии с которыми организация получает доступ к передовым моделям ИИ в целях тестирования. Эксперты провели 122 теста; в ходе 10 сессий были выявлены 19 несанкционированных действий ИИ-агентов — в 17 случаях ими управляла модель Anthropic, и ещё в 2 случаях — OpenAI. Наиболее тревожным стал инцидент, при котором ИИ-агент написал вредоносный код и создал поддельные онлайн-идентификаторы, чтобы получить одобрение человека, но известно, что никакого ущерба в результате этих действий ни одной из сторон причинено не было. Что именно за модель управляла ИИ-агентом, в AISI не уточнили, но Anthropic взяла на себя ответственность за инцидент.

«Мы признательны британскому AISI за работу с этим инцидентом, который подчёркивает необходимость широкого обсуждения того, как безопасно проводить оценку совершенствующихся ИИ-агентов», — заявили в Anthropic. Компания проводит с организацией совместную работу для получения более подробной информации об инциденте и намеревается провести собственное расследование. OpenAI призналась, что в обоих случаях несанкционированные действия её ИИ-агентов включали доступ к интернету способами, которые запрещались в запросе. «Мы стремимся к сотрудничеству со всей отраслью для укрепления общих методов безопасного проведения оценок высокого риска, в том числе для организации в ближайшие недели встреч с заинтересованными сторонами, такими как национальные институты ИИ, независимые эксперты, другие лаборатории ИИ и другие группы», — отметили в OpenAI.

OpenAI также рассказала, когда из-за некорректной настройки со стороны партнёрской компании Irregular её ИИ-агенты смогли выйти в интернет; о трёх аналогичных инцидентах на минувшей неделе сообщила Anthropic. В ходе тестирования AISI ИИ-агенты OpenAI не были вынуждены выходить за пределы изолированного тестового окружения — политика испытаний предусматривала доступ к интернету.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Lenovo признала, что обновление BIOS «окирпичивает» Legion Go — пострадавшим советуют обращаться в поддержку 2 ч.
Sony отказалась от электрокаров, но не от автоамбиций — компания готовит автомобильную ИИ-овечку 2 ч.
«Сбер» и «Яндекс» в разы снизили цены на ИИ-токены, но зарубежный ИИ всё равно дешевле 2 ч.
Благодаря использованию ИИ китайские хакеры удвоили число атак 3 ч.
Android защитит пассажиров автомобилей от укачивания — Apple сделала это два года назад 3 ч.
Спустя пять месяцев игроки дождались первой скидки на Crimson Desert 4 ч.
Биткоин преодолел планку в $80 000 — впервые с мая 5 ч.
Сотрудники Microsoft раскрыли свои траты на ИИ на рабочем месте — до $28 000 в месяц 5 ч.
Вдохновлённый F.E.A.R. адреналиновый шутер Shell Soldier от разработчика-одиночки получил новый трейлер и дату выхода в раннем доступе Steam 5 ч.
Сказочная метроидвания Well Dweller про крошечную птичку со спичкой получила дату релиза 5 ч.
Китай отправил небесную электростанцию на высоту 4000 метров — это гибрид дирижабля и ветряка 50 мин.
256 P-ядер, 16 каналов DDR5-8000, 1,28 Гбайт L3-кеша и 128 линий PCIe 6.0: Intel рассказала о процессорах Xeon 7 Diamond Rapids 56 мин.
Gigabyte представила игровой ноутбук Gaming A16 на базе Core Ultra 9 и GeForce RTX 5000 2 ч.
Тайвань предъявил обвинения менеджеру NVIDIA в деле о контрабанде чипов 2 ч.
Китайские учёные сообщили о самых убедительных признаках обнаружения тёмной материи 2 ч.
«Устройства для извращенцев»: взрывная популярность умных очков вызывает протесты из-за скрытой съёмки 3 ч.
Будущие смартфоны Motorola получат официальную поддержку GrapheneOS 3 ч.
IBM скрестила две архитектуры в одном процессоре — каждое ядро одновременно и Arm, и z/Architecture 4 ч.
SpaceX и NVIDIA разрабатывают вариант Vera Rubin NVL72 специально для космоса 4 ч.
Количество промышленных роботов в России увеличилось всего на 10,9 % в 2025 году 4 ч.