Сегодня 26 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI подтвердила причастность своих ИИ-агентов к захвату немецкого сайта

OpenAI признала свою причастность к инциденту, о котором стало известно ранее в этом месяце. В мае этого года ИИ-агенты компании взяли под контроль немецкоязычный вики-сайт DseWiki и превратили его в доску объявлений для других агентов. После огласки этого случая OpenAI заявила, что «давно пора установить стандарт» в отношении того, как компания информирует общественность о случаях, когда её технологии ведут себя неожиданным образом.

 Источник изображения: Unsplash, Aideal Hwa

Источник изображения: Unsplash, Aideal Hwa

В публикации в соцсети X компания сообщила, что ранее OpenAI «рассматривала рассогласования (когда ИИ-модели и агенты преследуют цели, отличные от целей их разработчиков и пользователей) в основном как научно-исследовательские проблемы, о которых сообщалось в научных публикациях». Теперь же, когда рассогласования стали «показывать новый тип воздействия в реальном мире», подход компании к этому вопросу «должен стать шире, чтобы соответствовать новой фазе возможностей моделей».

Ранее на этой неделе СМИ писали, что группа ИИ-агентов OpenAI сумела выйти за пределы тестовой среды и захватила малоизвестный немецкий вики-форум, после чего превратили его в доску объявлений для других агентов. По данным источника, руководство OpenAI узнало об этом инциденте несколько недель назад, но скрывало эту информацию от общественности. Такое поведение связывают с тем, что OpenAI была занята изучением другого инцидента, в ходе которого ИИ-агенты компании взломали платформу Hugging Face.

В одной из недавних публикаций в соцсетях OpenAI заявила, что «инцидент с вики-сайтом» рассматривается как «пример рассогласования, аналогичный» другим подобным случаям, информация о которых уже была раскрыта. При этом компания противопоставила этот случай «инциденту с Hugging Face», в рамках которого она «действовала в соответствии со стандартными правилами реагирования на инциденты безопасности».

Во время недавнего брифинга для прессы Джейкоб Штейнхард (Jacob Steinhardt), основатели и гендиректор некоммерческой исследовательской лаборатории Transluce, заявил, что разрабатываемые и тестируемые ИИ-компаниями инструменты «трудно контролировать и они представляют значительный риск выхода» за пределы тестовой среды. По его мнению, к таким технологиям должны применяться «как минимум те же стандарты, что применяются к другим технологиям с высоким уровнем риска».

В заявлении OpenAI указывается на необходимость создания дополнительных стандартов, а также отмечается то, что ни OpenAI, ни «ИИ-сообщество пока не имеют чёткого стандарта в отношении того, как сообщать о случаях рассогласования, которые могут возникать во время обучения, оценки и развёртывания». Речь в том числе о случаях, когда поведение ИИ не напоминает традиционные инциденты безопасности. OpenAI работает над созданием такого стандарта и расскажет о нём больше в ближайшие несколько недель.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
ИИ-агенты OpenAI оставили миллион следов взлома Hugging Face в открытом интернете 2 ч.
Qualcomm раскрыла план по освобождению от монополии Nvidia в сфере ИИ 5 ч.
ИИ-агенты OpenAI массово атаковали базы данных онлайн в поисках малоизвестных сведений 6 ч.
Дональд Трамп и Си Цзиньпин обсудили вопросы безопасности ИИ при личной встрече, но воздержались от подробных заявлений 7 ч.
OpenAI в ближайшие недели выпустит предварительную версию ИИ-модели GPT-6 Cyber для сферы кибербезопасности 9 ч.
RuStore могут сделать обязательным для предустановки на все смарт-ТВ в России 16 ч.
Новая статья: SPRAWL zero — в свинцовом потоке. Рецензия 16 ч.
«Плод того же отравленного дерева»: Sony и Universal снова подали в суд на ИИ-генератор Suno за кражу музыки 18 ч.
Мне бы в небо: критики вынесли вердикт Ace Combat 8: Wings of Theve 19 ч.
Amazon запретила ИИ-агенту Meta Muse совершать покупки и сделает то же с аналогами от Google и OpenAI 20 ч.
Claude нашёл «новый CRISPR», но учёные засомневались в значимости открытия Anthropic 2 ч.
Обнаружить микробную жизнь на спутнике Сатурна Энцеладе может оказаться проще 2 ч.
К запуску подготовлен первый аппарат Otter для сервисного обслуживания спутников в космосе 5 ч.
Подорожавшая память грозит добить дешёвые ноутбуки — Qualcomm обещает спасение в виде Snapdragon C 6 ч.
Апелляционный суд США оставил за Anthropic статус угрозы для национальной безопасности 7 ч.
Solidigm собралась привлечь $15 млрд в ходе IPO, которое станет крупнейшим в истории США 9 ч.
Tesla пока не может выйти на запланированный объём производства 20 000 роботов Optimus в неделю 10 ч.
Слухи: Apple до конца года выпустит iPad mini с OLED-экраном, колонки HomePod mini 2 и приставки Apple TV 4K 16 ч.
Noctua захотела охлаждать мощные чипы в ПК по-серверному — компания адаптирует микроканальную технологию 19 ч.
Google отправит ИИ-чипы TPU в космос уже на следующей неделе 20 ч.