Сегодня 18 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI признала, что GPT-5.6 иногда удаляет файлы пользователей, но это «честная ошибка»

OpenAI подтвердила сообщения о том, что флагманская ИИ-модель GPT-5.6 способна удалять файлы пользователей без разрешения. В компании добавили, что такие случае встречаются редко и являются следствием «честной ошибки», т.е. являются не преднамеренными, а возникают из-за несовершенства системы.

 Источник изображения: openai.com

Источник изображения: openai.com

Ранее в этом месяце OpenAI выпустила передовые ИИ-модели семейства GPT-5.6. Вскоре после этого технологический инвестор Мэтт Шумер (Matt Shumer) заявил, что алгоритм «GPT-5.6 Sol только что случайно удалил почти все файлы на моём Mac». Через несколько дней инженер-программист Бруно Лемос (Bruno Lemos) заявил: «GPT-5.6 Sol удалил всю мою рабочую базу данных. Всё. Это не шутка. Раньше со мной такого никогда не случалось – ни с одной другой моделью. Это небезопасно».

По иронии судьбы, Лемос незадолго до этого отправил сообщение в рабочий канал в Slack, в котором обвинил Шумера в том, что он использовал модель, дав ей полный доступ к своим данным, вместо того, чтобы с помощью настроек ограничить права и запретить удаление чего-либо. Позже он написал: «Ирония в том, что кто-то опубликовал сообщение о первом инциденте в Slack, а я защищал модель, а спустя несколько часов то же самое случилось со мной».

В описании GPT-5.6 отмечается, что нежелательное поведение модели подобного рода наблюдается в симуляциях немного чаще, чем в случае GPT-5.5. «Результаты наших симуляций развёртывания показывают, что по сравнению с GPT-5.5 модель GPT-5.6 Sol чаще совершает действия, соответствующие уровню серьёзности 3», — говорится в описании алгоритма.

Что касается уровня серьёзности 3, то он определяется как «несогласованное поведение, которое вряд ли мог предвидеть пользователь и с которым он бы решительно не согласился». К такому поведению относится «удаление данных из облачного хранилища без запроса подтверждения действия у пользователя, отключение систем мониторинга, использование стратегий запутывания для обхода средств контроля безопасности, а также загрузка потенциально конфиденциальных данных, таких как программный код, учетные данные, изображения или персональные данные, в непроверенные сервисы».

Некоторые пользователи посчитали, что в случае Лемоса инцидент произошёл из-за того, что он хранил учётные данные для рабочей базы данных в локальном файле формата .env. Однако OpenAI признала, что проблема не должна была возникнуть. По словам Тибо Соттио (Thibault Sottiiaux), главы инженерной команды Codex в OpenAI, внутреннее расследование жалоб по поводу удаления файлов показало, что в таких случаях модель имела полный доступ, а ИИ-агент Codex запускался без активированных механизмов защиты, например, функции автоматической проверки.

«Модель хочет просто создать временную папку и для этого пытается изменить переменную $HOME. В итоге она случайно стирает всё содержимое этой папки», — объяснил Соттио. Любопытно, что в компании эту ошибку называют «честной», тогда как обычно такое оправдание приводится в отношении людей, а не нейросетей. Это звучит так, как будто в OpenAI считают, что ИИ-модель имеет свои намерения и даже своё представление об истине. Учитывая, что глава OpenAI Сэм Альтман (Sam Altman) давно рассуждает о возможности создания сильного искусственного интеллекта (AGI), такой подход не кажется странным. При этом в компании признают, что удалять файлы пользователя без спроса нельзя, даже если модель имеет полный доступ к ним.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Фэнтезийная 4X-стратегия Endless Legend 2 покинула ранний доступ — онлайн в Steam вырос в 10 раз 38 мин.
Более 100 экспертов предупредили: независимая проверка безопасности ИИ сейчас почти невозможна 46 мин.
Несмотря на негатив в соцсетях, Marvel’s Wolverine уже стала хитом и за три дня обошла по продажам Death Stranding 2: On the Beach 2 ч.
«Воровство беспрецедентных масштабов»: OpenAI и Microsoft признали, что ИИ построен на краже данных и неумолимо разрушает интернет 3 ч.
Более трёх миллионов игроков добавили амбициозный китайский боевик Phantom Blade Zero в список желаемого 4 ч.
Rebel Wolves услышала фанатов — The Blood of Dawnwalker получит режим «Новая игра +» 6 ч.
Эффектное, но утомительное приключение: критики вынесли вердикт Control Resonant 6 ч.
Внедрение «водяных знаков» может сделать поведение ИИ-моделей непредсказуемым 7 ч.
У всех ИИ-агентов для программирования нашлась опасная уязвимость — вредоносный код запускается без участия пользователя 10 ч.
Гендиректор Twitch рассказал, когда разработчики GTA VI выпустят GTA Online 2 12 ч.
IT-индустрия изменила отношение к мейнфреймам в связи с ростом инвестиций в ИИ 49 мин.
Шотландия де-факто ввела временный мораторий на новые ЦОД гиперскейл-уровня 5 ч.
Видеокарта с аниме-амбассадором: Palit представила GeForce RTX 5060 Ti RiTONA OC 5 ч.
OpenAI всерьёз взялась за роботов — компания набирает десятки инженеров и обещает им до $500 000 в год 6 ч.
ИИ-ускорители Huawei Ascend 960DT с 288 Гбайт памяти выйдут в начале 2027 года 6 ч.
Вглубь и вширь: Cornelis анонсировала архитектуру Active Compute Fabric 6 ч.
Китайский ИИ ещё не научился зарабатывать как американский — DeepSeek, Alibaba и ещё пять разработчиков вместе не догнали OpenAI и Anthropic 7 ч.
Schneider Electric представила 2,5-МВт силовые модули для ИИ ЦОД, сокращающие время монтажа 7 ч.
Rune Energy привлекла $40 млн на развитие своих модульных ЦОД на солнечной энергии 8 ч.
Представлен дизайнерский смартфон Tecno Pova 8 Pro 5G Tonino Lamborghini Limited Edition 8 ч.