Сегодня 30 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Система модерации на основе ИИ сервиса Discord ошибочно заблокировала более 8000 безобидных аккаунтов

Система модерации Discord на основе ИИ за последние два месяца заблокировала более 8000 пользователей после того, как загруженные ими изображения были ошибочно помечены как вредоносный контент.

 Источник изображения:  Mariia Shalabaieva/unsplash.com

Источник изображения: Mariia Shalabaieva/unsplash.com

Среди изображений, вызывавших ложные срабатывания, были электронные таблицы, шахматные доски, игровые текстуры и простые прозрачные фоны. Discord сообщила, что за минувшие выходные были заблокированы ещё 200 пользователей, прежде чем компания выявила и исправила проблему. Инцидент напоминает о том, что автоматическая модерация может нанести реальный ущерб, когда ИИ-системы проверки дают сбой.

По данным TechCrunch, Discord заявила, что её система предназначена для сопоставления загруженных изображений с базами данных известных вредоносных материалов. Когда система помечает контент как вредоносный, его должен проверить человек, прежде чем платформа предпримет какие-либо действия. Этот процесс проверки дал сбой. Издание The Verge сообщило, что ошибка привела к блокировке пользователей, помеченных, как публикующих вредоносный контент. Хотя на деле она должна была сначала обеспечить временную блокировку возможности загрузки контента в рамках проверки. Сервис Discord также сообщил, что другая ошибка препятствовала автоматическому снятию некоторых блокировок после того, как сотрудники проверили и посчитали аккаунты «чистыми».

Проще говоря, в Discord существует защита от ложных срабатываний, но рабочий процесс её применения не работал так, как положено. Для пользователей результат оказался плачевным: безобидные изображения приводили к блокировке их аккаунтов. Для Discord ошибка в системе проверки изображений стала нарушением доверия и безопасности, затронувшим тысячи аккаунтов, прежде чем её исправили.

Автоматизированные системы модерации могут работать быстрее, чем люди-модераторы, поэтому крупные платформы используют их для поиска вредоносного контента в больших масштабах. Риск возникает, когда автоматические сигналы запускают действия с аккаунтом до того, как проверка выявит ошибку.

Случай с Discord показывает, почему нельзя исключать человеческий контроль над ИИ. Если система может лишить аккаунт доступа до завершения проверки, командам платформы необходимы чёткие механизмы контроля, чтобы предотвратить превращение временного сигнала в полную блокировку. Платформа Discord заявляет, что уже исправила ошибку и сейчас восстанавливает затронутые аккаунты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про социальные сети

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Официальный трейлер осенней распродажи Steam рассекретил часть игр, которые получат скидки 2 мин.
Журналисты раскрыли новые скриншоты и подробности GTA VI — животный мир, переработанная погода из RDR 2 и думскроллинг 2 ч.
Cloud.ru разместит второй выпуск биржевых облигаций объёмом не менее 10 млрд рублей 8 ч.
Платформа NVIDIA Open Agent Safety Platform обеспечит безопасное использование ИИ-агентов — от тестирования до развёртывания 8 ч.
На OpenAI подали в суд за взлом Hugging Face и игнорирование рисков автономного ИИ 9 ч.
OpenAI представила GPT‑6.1 Sol — почти как флагманская GPT‑6 Astra в сложных задачах, но в пять раз дешевле 9 ч.
AMD выпустила драйвер с поддержкой кампании Call of Duty: Modern Warfare 4, ремастера The Witcher 3: Wild Hunt, Gears of War: E-Day и других новых игр 11 ч.
OpenAI представила Dots — ИИ-агентов с собственными компьютерами, которые могут работать круглосуточно без пользователя 11 ч.
The Witcher 3: Wild Hunt спустя 11 лет установила новый рекорд популярности в Steam — всё благодаря ремастеру 13 ч.
«Требуем фильм или сериал по Ace Combat»: финал короткометражки Hour Zero по Ace Combat 8: Wings of Theve привёл фанатов в восторг 13 ч.
Американские ИИ-гиганты в присутствии Трампа договорились о саморегулировании в области безопасности 24 мин.
Gigabyte выпустила Micro-ATX-плату B760M Aorus Ari WiFi6E в аниме-дизайне, с поддержкой графики PCIe 5.0 и DDR4 4 ч.
iFixit выявили первое реальное улучшение ремонтопригодности в наушниках Apple AirPods 5 5 ч.
Новая статья: Обзор материнской платы MSI Z890 GAMING PLUS WIFI6E: дешевле не значит хуже? 7 ч.
Оператор ЦОД Virtus привлёк рекордные £2,45 млрд на развитие ЦОД в Великобритании и материковой Европе 7 ч.
Дженсен Хуанг уверен в завтрашнем дне — NVIDIA увеличила сумму выкупа акций и планирует повысить дивиденды 8 ч.
Новая статья: Обзор UWQHD VA-монитора DIGMA Overdrive 34A712Q: для ценителей 9 ч.
Снова без изменений: утечка раскрыла дизайн Google Pixel 11a 9 ч.
SteelSeries представила беспроводные игровые мыши Sensei Pro и Rival Pro с широкополосным беспроводным подключением 10 ч.
Honor представила крошечный букридер с 3,68-дюймовым экраном E-Ink — он крепится магнитами на тыл смартфона 11 ч.