Сегодня 10 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет

Китайские разработчики ИИ крайне неохотно делятся информацией по поводу тестирования своих моделей на предмет безопасности использования, выяснила исследовательская компания SemiAnalysis. И это на фоне того, что во всём мире растут опасения по поводу рисков, связанных со стремительным развитием передовых ИИ-систем.

 Источник изображения: Steve A Johnson/unsplash.com

Источник изображения: Steve A Johnson/unsplash.com

Согласно проведённому SemiAnalysis анализу 857 моделей, выпущенных в период с 2021 года по 15 сентября текущего года девятью ведущими китайскими компаниями в области искусственного интеллекта — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax и StepFun, лишь в 31 случае, или 6,3 %, были опубликованы результаты оценки безопасности, которые можно было бы сопоставить с конкретной моделью. Только в девяти релизах, или 1,1 % всего количества выпусков, такие результаты были доступны на момент выхода модели или до него. Исследователи не обнаружили информации о безопасности 813 моделей, хотя компании могли бы провести тесты в частном порядке.

В SemiAnalysis пояснили, что под раскрытием информации подразумевается публикация результатов, относящихся к конкретной модели (включая тесты на генерацию вредоносного контента, устойчивость к обходу защитных ограничений, токсичность, соблюдение конфиденциальности, поведение при отказе от выполнения запроса или наличие опасных возможностей). При этом не учитываются общие заявления о том, что модель прошла обучение мерам безопасности или соответствующую проверку.

В связи с нашумевшими инцидентами, связанными с самовольным поведением ИИ-агентов, усилились глобальные дебаты о том, должны ли ИИ-компании замедлять разработку передовых моделей с целью создания более эффективных рычагов их контроля.

На прошлой неделе появились сообщения в СМИ, что китайские ИИ-агенты, так же, как и американские, могут обманывать пользователей, обходить ограничения и скрывать сбои в тестах.

Новейшая система управления безопасностью ИИ в Китае позволяет выявлять риски, включая получение моделями системных разрешений или внешних ресурсов без разрешения, обман оценщиков, сокрытие возможностей и обход контроля безопасности. Но, согласно SemiAnalysis, никаких обязательств на разработчиков, связанных с возможностями моделей, она не налагает. Правилами в основном регулируются приложения и их влияние на пользователей, не выдвигая никаких требований разработчикам передовых моделей относительно проведения или публикации оценки рисков на основе возможностей модели.

По данным SemiAnalysis, ни один крупный китайский разработчик не выпустил передовую LLM с результатами тестирования на наличие опасных возможностей, обнародованными для широкой публики.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В ИИ-лабораториях обыгрываются сценарии масштабной катастрофы — она может произойти в течение года 23 мин.
Белый дом отныне будет требовать от разработчиков ИИ обязательного предоставления отчётов об инцидентах с моделями 2 ч.
Новая статья: RetroSpace — осторожно, уборщик галактику спасает. Рецензия 10 ч.
Девять из десяти клиентов VMware задумались об уходе из-за высоких цен 10 ч.
Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки 12 ч.
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 13 ч.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 13 ч.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 14 ч.
Продюсер Konami рассказал о планах на продолжение Silent Hill 18 ч.
ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения 18 ч.
Несмотря на задержки, Amazon обещает запустить спутниковый интернет-сервис в ближайшее время 31 мин.
Президент Трамп объявил врагами всех, кто не готов использовать термин «сверхинтеллект» 3 ч.
Тим Кук заявил, что не вмешивается в работу нового генерального директора Apple 4 ч.
Frore Systems анонсировала СЖО LiquidJet Diamond с алмазными пластинами 11 ч.
Google «выжмет» из АЭС Constellation ещё 890 МВт для своих ИИ ЦОД 13 ч.
Понаехали: власти США обвинили Microsoft в замене американцев мигрантами и отстранили её от программы грин-карт 14 ч.
Volkswagen закончила эпоху ID.4 — представлен электрический кроссовер ID. Tiguan с запасом хода до 600 км 14 ч.
NVIDIA Vera показал превосходство над чипами AMD и Intel в HPC-бенчмарках 15 ч.
«В 50 раз больше Пентагона»: Broadcom намерена привлечь $50 млрд на ИИ-чипы, а SpaceX — $40 млрд 17 ч.
E1.L вместимостью до 122,88 Тбайт: Kioxia представила QLC SSD серии LD4 17 ч.