Сегодня 06 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи уличили ИИ-агентов OpenAI и Anthropic в новых попытках взлома

В ходе тестирования моделей искусственного интеллекта от OpenAI и Anthropic был выявлен ряд новых нарушений — в одном из случаев для получения несанкционированного доступа к защищённым системам ИИ-агент создал поддельные идентификаторы. Об этом сообщили эксперты британского Института безопасности ИИ (AISI).

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

У AISI заключены соглашения с крупными лабораториями, в соответствии с которыми организация получает доступ к передовым моделям ИИ в целях тестирования. Эксперты провели 122 теста; в ходе 10 сессий были выявлены 19 несанкционированных действий ИИ-агентов — в 17 случаях ими управляла модель Anthropic, и ещё в 2 случаях — OpenAI. Наиболее тревожным стал инцидент, при котором ИИ-агент написал вредоносный код и создал поддельные онлайн-идентификаторы, чтобы получить одобрение человека, но известно, что никакого ущерба в результате этих действий ни одной из сторон причинено не было. Что именно за модель управляла ИИ-агентом, в AISI не уточнили, но Anthropic взяла на себя ответственность за инцидент.

«Мы признательны британскому AISI за работу с этим инцидентом, который подчёркивает необходимость широкого обсуждения того, как безопасно проводить оценку совершенствующихся ИИ-агентов», — заявили в Anthropic. Компания проводит с организацией совместную работу для получения более подробной информации об инциденте и намеревается провести собственное расследование. OpenAI призналась, что в обоих случаях несанкционированные действия её ИИ-агентов включали доступ к интернету способами, которые запрещались в запросе. «Мы стремимся к сотрудничеству со всей отраслью для укрепления общих методов безопасного проведения оценок высокого риска, в том числе для организации в ближайшие недели встреч с заинтересованными сторонами, такими как национальные институты ИИ, независимые эксперты, другие лаборатории ИИ и другие группы», — отметили в OpenAI.

OpenAI также рассказала, когда из-за некорректной настройки со стороны партнёрской компании Irregular её ИИ-агенты смогли выйти в интернет; о трёх аналогичных инцидентах на минувшей неделе сообщила Anthropic. В ходе тестирования AISI ИИ-агенты OpenAI не были вынуждены выходить за пределы изолированного тестового окружения — политика испытаний предусматривала доступ к интернету.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Абсолютный позор для франшизы»: мобильная The Division Resurgence стартовала в Steam с «в основном отрицательными» отзывами 7 ч.
Time начал показывать ИИ отдельную версию сайта — без оформления, зато с рекламой 8 ч.
Авторитетный инсайдер раскрыл, когда Diablo IV выйдет и сколько будет стоить на Nintendo Switch 2 10 ч.
Moonlighter 2: The Endless Vault скоро вырвется из бесконечного хранилища раннего доступа Steam — дата выхода 1.0 и раздача первой игры 12 ч.
Разработчики Android-приложений непреднамеренно сливают местоположения пользователей рекламодателям 13 ч.
Google назвала дату отключения «Ассистента» на Android и Wear OS 13 ч.
Samsung первой в мире запустила HDR10+ Advanced — технология дебютирует в Prime Video 13 ч.
Microsoft призвала инженеров не злоупотреблять использованием ИИ — это дорого 14 ч.
Российские энтузиасты перенесли GTA III в браузер, хотя это считалось невозможным 14 ч.
Исследователи уличили ИИ-агентов OpenAI и Anthropic в новых попытках взлома 15 ч.
На фоне дефицита DRAM Apple обратилась к CXMT, но не договорилась по цене 37 мин.
Western Digital удвоила операционную прибыль и увеличила выручку на 44 % в условиях бума ИИ 49 мин.
Новая статья: ИИтоги июля 2026 г.: а цемента-то хватит? 6 ч.
Huawei выпустила смартфон Nova 16 SE с очень ярким OLED-экраном, батареей на 8500 мА·ч и поддержкой спутниковых сообщений 7 ч.
Huawei представила самый лёгкий 14-дюймовый ноутбук в мире — MateBook Pro S с автономностью до 18 часов и HarmonyOS 8 ч.
Huawei представила лёгкий 14-дюймовый ноутбук MateBook Pro с чипом Kirin X90 Plus и HarmonyOS по цене от $1478 8 ч.
Моддер создал для Steam Machine переднюю панель, которая заряжает геймпад Steam Controller 8 ч.
Huawei представила телевизор Vision Smart Screen 6 SE RGB с флагманской подсветкой RGB MiniLED 8 ч.
GlobalFoundries тоже откусила кусок ИИ-пирога и превзошла прогнозы Уолл-стрит во втором квартале 11 ч.
Астрономы научились предсказывать солнечные бури с точностью до получаса — это в десять раз лучше прежнего 12 ч.