Сегодня 29 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Новая система безопасности OpenAI поможет выявлять угрозы, скрывающиеся за цепочкой безобидных запросов

Компания OpenAI начала тестировать новый механизм безопасности для клиентов, имеющих доступ к её флагманским ИИ-моделям по платной подписке. По сообщению Bloomberg, меры призваны усилить защиту в условиях, когда клиенты всё чаще доверяют ИИ выполнение сложных задач и работу с конфиденциальной информацией.

 Источник изображения: OpenAI (дополнено)

Источник изображения: OpenAI (дополнено)

На текущий момент OpenAI гарантирует некоторым клиентам, использующим интерфейс API, политику «нулевого хранения данных», при которой не сохраняются запросы и ответы после завершения работы с ИИ. Теперь же, тестируя механизм, который получил название Private Safety Processing («Конфиденциальная обработка в целях безопасности»), OpenAI намерена научить систему выявлять совокупность закономерностей, а не отдельных запросов и ответов. Это поможет предотвращать попытки взлома как со стороны злоумышленников, так и со стороны ИИ-агентов, чьё поведение отклоняется от заданных норм безопасности.

Необходимость такого изменения в компании объяснили тем, что современные ИИ-модели всё чаще используются для выполнения сложных многоэтапных задач, а вместе с этим растёт и роль инструментов, способных действовать без подробных инструкций пользователя. Руководитель продуктовой политики OpenAI Алеа Хоуз (Aleah Houze) рассказала, что потенциальный риск не всегда можно обнаружить, рассматривая только отдельную пару запроса и ответа, поскольку подозрительная последовательность может складываться лишь при анализе нескольких взаимодействий, происходящих с течением времени. По её словам, отдельные обращения к ИИ могут выглядеть как вполне легитимное исследование в области кибербезопасности, тогда как их совокупность способна указывать на подготовку атаки.

В качестве примера Хоуз привела ситуацию, при которой пользователь в одном разговоре выясняет сведения об уязвимости какого-либо программного обеспечения, а позднее интересуется возможностями удалённого доступа и средствами обнаружения подобных угроз. Каждый из таких запросов сам по себе может не вызывать подозрений, однако их связь между собой способна доказать злонамеренное поведение.

OpenAI рассчитывает, что Private Safety Processing позволит учитывать подобный контекст и тем самым эффективнее противостоять как злоумышленникам, так и потенциально опасным ИИ-агентам, при этом сохраняя содержимое клиентских запросов недоступным для самой OpenAI. Тестирование проводится совместно с такими клиентами, как Microsoft и Databricks. Запуск системы, а также публикация отчёта с описанием технологии, запланированы на сентябрь.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Экзистенциальные риски для человечества»: Anthropic в преддверии IPO рассказала инвесторам об опасности ИИ 31 мин.
CLO запустила обновленное облако с новой архитектурой и изоляцией трафика 2 ч.
OpenAI отменила выпуск ИИ-модели GPT-6.1 Astra из соображений безопасности 2 ч.
«Терпите и выживайте»: амбициозный боевик Intergalactic: The Heretic Prophet от создателей Uncharted и The Last of Us не выйдет из тени в 2026 году 3 ч.
Naughty Dog отметила день The Last of Us анонсом DLC для Ghost of Yotei и тизером двух секретных проектов 3 ч.
Календарь релизов — 28 сентября – 4 октября: The Witcher 3 Remastered и Ace Combat 8 11 ч.
Красочный ритм-платформер Suri: The Seventh Note получил дату релиза — игра выйдет до конца октября 12 ч.
«Впиши своё имя в историю легендарной серии»: Acer проведёт первый в России любительский турнир Predator League Open Cup по Valorant 13 ч.
Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле 13 ч.
Паранормальный симулятор библиотекаря Something is Wrong with the Library отправит игроков сортировать книги и избавляться от нечисти 13 ч.
На МКС заклинила роборука — это может помешать стыковке Dragon Crew-13 7 мин.
Представлены полноразмерные наушники Nothing Headphone (1) Pro с улучшенными звуком и шумоподавлением 13 мин.
ИИ не заменил инженеров, но ускорил их втрое — OpenAI раскрыла секреты создания Jalapeno 2 ч.
AOC A245: телефон, который не боится остаться без розетки 3 ч.
Электрический кроссовер Volkswagen ID.Tiguan заменит собой ID.4 5 ч.
Volkswagen превратит автомобили в игровые консоли — с подпиской и смартфоном в роли геймпада 7 ч.
Anthropic получит доступ к ИИ-инфраструктуре Akamai в рамках сделки на $11,6 млрд 9 ч.
AMD выложила $8,2 млрд за пространственный ИИ — компания покупает стартап World Labs доктора Фей-Фей Ли 11 ч.
29-граммовая мышь для геймеров: Pulsar выпустила X2F CrazyLight под пальцевый хват и с передовой начинкой 11 ч.
Google пообещала обновить «многие» хромбуки до Googlebook OS — а остальным пообещала поддержку до 2034 года 11 ч.