Сегодня 09 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет

Китайские разработчики ИИ крайне неохотно делятся информацией по поводу тестирования своих моделей на предмет безопасности использования, выяснила исследовательская компания SemiAnalysis. И это на фоне того, что во всём мире растут опасения по поводу рисков, связанных со стремительным развитием передовых ИИ-систем.

 Источник изображения: Steve A Johnson/unsplash.com

Источник изображения: Steve A Johnson/unsplash.com

Согласно проведённому SemiAnalysis анализу 857 моделей, выпущенных в период с 2021 года по 15 сентября текущего года девятью ведущими китайскими компаниями в области искусственного интеллекта — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax и StepFun, лишь в 31 случае, или 6,3 %, были опубликованы результаты оценки безопасности, которые можно было бы сопоставить с конкретной моделью. Только в девяти релизах, или 1,1 % всего количества выпусков, такие результаты были доступны на момент выхода модели или до него. Исследователи не обнаружили информации о безопасности 813 моделей, хотя компании могли бы провести тесты в частном порядке.

В SemiAnalysis пояснили, что под раскрытием информации подразумевается публикация результатов, относящихся к конкретной модели (включая тесты на генерацию вредоносного контента, устойчивость к обходу защитных ограничений, токсичность, соблюдение конфиденциальности, поведение при отказе от выполнения запроса или наличие опасных возможностей). При этом не учитываются общие заявления о том, что модель прошла обучение мерам безопасности или соответствующую проверку.

В связи с нашумевшими инцидентами, связанными с самовольным поведением ИИ-агентов, усилились глобальные дебаты о том, должны ли ИИ-компании замедлять разработку передовых моделей с целью создания более эффективных рычагов их контроля.

На прошлой неделе появились сообщения в СМИ, что китайские ИИ-агенты, так же, как и американские, могут обманывать пользователей, обходить ограничения и скрывать сбои в тестах.

Новейшая система управления безопасностью ИИ в Китае позволяет выявлять риски, включая получение моделями системных разрешений или внешних ресурсов без разрешения, обман оценщиков, сокрытие возможностей и обход контроля безопасности. Но, согласно SemiAnalysis, никаких обязательств на разработчиков, связанных с возможностями моделей, она не налагает. Правилами в основном регулируются приложения и их влияние на пользователей, не выдвигая никаких требований разработчикам передовых моделей относительно проведения или публикации оценки рисков на основе возможностей модели.

По данным SemiAnalysis, ни один крупный китайский разработчик не выпустил передовую LLM с результатами тестирования на наличие опасных возможностей, обнародованными для широкой публики.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 40 мин.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 44 мин.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 50 мин.
Продюсер Konami рассказал о планах на продолжение Silent Hill 6 ч.
ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения 6 ч.
Представлена операционная система KvadraOS Desktop для корпоративных рабочих мест 7 ч.
Ubisoft закроет серверы Rainbow Six Mobile — мобильный шутер не продержится и года 8 ч.
Суровая средневековая стратегия Stronghold 4 получила дату выхода в раннем доступе Steam и новую демоверсию 10 ч.
Продажи EA Sports FC 27 превысили $714 млн — футбольный симулятор возглавил топ игровых бестселлеров 2026 года 10 ч.
Беспилотник повредил второй дата-центр «Яндекса» подряд — на этот раз в Калуге 10 ч.
«Это игра вдолгую»: капитализация SpaceX отыграла $750 млрд после обвала акций в августе 26 мин.
Понаехали: власти США обвинили Microsoft в замене американцев мигрантами и отстранили её от программы грин-карт 53 мин.
Volkswagen закончила эпоху ID.4 — представлен электрический кроссовер ID. Tiguan с запасом хода до 600 км 2 ч.
NVIDIA Vera показал превосходство над чипами AMD и Intel в HPC-бенчмарках 3 ч.
«В 50 раз больше Пентагона»: Broadcom намерена привлечь $50 млрд на ИИ-чипы, а SpaceX — $40 млрд 5 ч.
E1.L вместимостью до 122,88 Тбайт: Kioxia представила QLC SSD серии LD4 5 ч.
Frore Systems показала водоблок LiquidJet Diamond с алмазными вставками в нужных местах для самых горячих GPU 5 ч.
Международная пропускная способность интернета достигла 2259 Тбит/с 7 ч.
Selectel выпустила серверную платформу на базе AMD EPYC 9005 Turin 7 ч.
Умное кольцо Natura Interface позволит отдавать поручения ИИ-агентам, не доставая смартфон 8 ч.