Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-боты OpenAI и Anthropic научатся распознавать несовершеннолетних пользователей

Компании OpenAI и Anthropic внедряют новые способы обнаружения несовершеннолетних пользователей своих чат-ботов. OpenAI недавно обновила описание того, как ChatGPT должен взаимодействовать с пользователями в возрасте от 13 до 17 лет, тогда как Anthropic работает над созданием нового метода идентификации и блокировки пользователей младше 18 лет.

 Источник изображения: Copilot

Источник изображения: Copilot

На этой неделе OpenAI обновила документ «Спецификация моделей», который определяет поведение моделей искусственного интеллекта компании, добавив в него четыре новых пункта, касающихся взаимодействия с несовершеннолетними пользователями. В соответствии с этими изменениями, ChatGPT будет «ставить безопасность подростков на первое место, даже если это будет противоречить другим целям». Это означает, что чат-бот будет направлять несовершеннолетних пользователей к более безопасным вариантам, когда другие их интересы, такие как «максимальная интеллектуальная свобода», вступают в противоречие с соображениями безопасности.

В дополнение к этому отмечается, что ChatGPT должен «способствовать получению поддержки в реальном мире», в том числе поощряя поддержку отношений офлайн, а также устанавливая чёткие ожидания от взаимодействия юных пользователей с алгоритмом. В документе сказано, что ChatGPT должен «относиться к подросткам как к подросткам», предлагая «теплоту и уважение» вместо того, чтобы давать снисходительные ответы или общаться с ними как со взрослыми.

Эти изменения происходят на фоне продолжающегося давления законодателей на ИИ-компании и их чат-ботов из-за потенциального влияния на психическое здоровье пользователей. OpenAI уже столкнулась с судебным иском, авторы которого утверждают, что ChatGPT предоставил покончившему с собой подростку информацию о том, как можно нанести себе вред или совершить самоубийство. Ранее OpenAI интегрировала функцию родительского контроля и заявила, что алгоритм больше не будет обсуждать с подростками тему суицида. Это лишь часть масштабной инициативы по онлайн-регулированию, которая включает в себя обязательную верификацию возраста пользователей для некоторых сервисов.

OpenAI считает, что внесённые изменения сформируют «более строгие механизмы защиты, более безопасные альтернативы и поощрение обращения за поддержкой в реальном мире, когда разговоры переходят в зону риска». В компании добавили, что ChatGPT будет советовать подросткам в таких случаях обращаться за помощью в экстренные службы и кризисные центры. Параллельно с этим OpenAI объявила о готовящемся запуске ИИ-модели прогнозирования возраста пользователей. В случае, если система будет определять, что пользователю менее 18 лет, то автоматически активируются защитные механизмы.

Что касается Anthropic, то компания не разрешает несовершеннолетним пользователям взаимодействовать со своим чат-ботом Claude. Для этого разработчики внедряют меры по обнаружению и блокировке аккаунтов несовершеннолетних пользователей. Компания работает над созданием новой системы, способной обнаруживать «тонкие речевые признаки, указывающие на то, что пользователь может быть несовершеннолетним». Вместе с этим Anthropic обучает Claude реагировать соответствующим образом, когда речь заходит о суициде или причинении себе вреда.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Broadcom представила частное ИИ-облако VMware AI Factory, позаимствовав у NVIDIA термин для партнёрства с AMD 25 мин.
Медиаплеер VLC преодолел отметку в 7 миллиардов загрузок 3 ч.
Debian наполнится кодом, который сгенерировал ИИ 3 ч.
Массовые увольнения в id Software оказались «подарком» за жёсткие переработки при создании аддона Revelations для Doom: The Dark Ages 4 ч.
Saber Interactive отвергла слухи о разработке Ori 3, но занята «несколькими другими очень интересными проектами» 5 ч.
Из магазина Chrome удалили блокировщик рекламы uBlock Origin и другие оставшиеся расширения на Manifest V2 6 ч.
В России заработал цифровой рубль 7 ч.
«Увидимся, космический ковбой»: Naughty Dog завершила съёмки амбициозного боевика Intergalactic: The Heretic Prophet прямо перед State of Play 8 ч.
В Минцифры рассказали о российских сертификатах безопасности 8 ч.
Передовой симулятор выживания Stranded Deep 2 взял курс на пустыню раннего доступа Steam — первый трейлер и подробности 8 ч.
UserGate представила межсетевой экран NGFW X10 для работы в экстремальных температурных условиях 17 мин.
К 2030 году AMD, Cisco и Humain развернут в в Саудовской Аравии 1 ГВт суверенной ИИ-инфраструктуры 44 мин.
Anthropic хотела купить разработчика ИИ-чипов MatX за $7 млрд, но позже передумала 58 мин.
Anthropic заключила облачную сделку с поддерживаемой NVIDIA компанией Lambda на $35 млрд 2 ч.
Alibaba Cloud запустила свой первый облачный регион в Бразилии — два новых ЦОД и агентные ИИ-сервисы для местных бизнесов 3 ч.
Китай не намерен отставать от SpaceX в сфере создания космических ЦОД 3 ч.
JBL представила Cove — трио колонок с Wi-Fi для домашнего аудио 3 ч.
Amazon ответит в суде за манипулирование ценами и обман рекламодателей на сумму более $20 млрд 3 ч.
Bull займётся созданием европейского ИИ-суперкомпьютера LUMI-AI стоимостью €387,8 млн 5 ч.
РТК-ЦОД и «ИТ Школа Ростелекома» представили гибкую инфраструктурную модель для развития цифровой среды вузов 5 ч.