Сегодня 04 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → дистилляция

OpenAI обвинила китайскую Moonshot в массовом извлечении данных для обучения ИИ-моделей

Ведущие американские разработчики ИИ-моделей уже не раз обвиняли китайских конкурентов в дистилляции собственных продуктов, и OpenAI недавно предъявила китайской Moonshot претензию по поводу массового извлечения данных для обучения моделей этого стартапа. Соответствующую подозрительную активность OpenAI заметила в начале июля.

 Источник изображения: Moonshot AI

Источник изображения: Moonshot AI

Извлечённые китайскими разработчиками данные, по мнению создателей GPT, могут быть использованы ими для воспроизведения возможностей ИИ-моделей OpenAI в части рассуждений, помимо прочего. По словам представителей OpenAI, с начала июля компания наблюдала тысячи попыток получить скрытую информацию о том, как её собственные ИИ-модели решают задачи, требующие рассуждений и формирования логических выводов. Эти попытки предпринимались пользователями её ИИ-моделей, предположительно связанными с китайской Moonshot AI. Координированные усилия по извлечению нужных данных начались в июле, и в том же месяце в пике они исчислялись 16 тысячами запросов. При этом OpenAI не уверена, что все операторы с китайской стороны действовали в интересах одной только Moonshot, но именно этот стартап играл ключевую роль в этих попытках.

Быстрый прогресс способностей китайской ИИ-модели Kimi K3 компании Moonshot уже вызывал у американских чиновников вопросы к условиям, обеспечившим подобный успех. Китайский стартап подозревается в активной дистилляции передовых ИИ-моделей OpenAI, Anthropic и Google. По словам представителей OpenAI, подобная активность с китайской стороны нарушает правила использования ИИ-моделей этой американской компании. Сама OpenAI при этом поддерживает экосистему ИИ-моделей с открытыми весами, сторонниками которой являются многие китайские разработчики, и надеется, что США смогут сохранить мировое лидерство и в этой сфере.

OpenAI предпринимает попытки защитить свои ИИ-модели от дистилляции сторонними разработчиками, скрывая логические цепочки, которые обеспечивают пользователей искомыми ответами. Действующим в интересах Moonshot операторам, как отмечает американский стартап, удалось обойти эти ограничения, скопировав зашифрованную информацию об этих цепочках из одного диалога, и попросив ИИ-модель расшифровать её в отдельном запросе. Китайцы пытались получить информацию о версии рассуждающего алгоритма, которая применяется только на серверах OpenAI, но не смогли её расшифровать. Эволюционный характер этих атак после усиления мер защиты со стороны OpenAI, по мнению представителей стартапа, является доказательством востребованности искомых данных для обучения китайских ИИ-моделей.

По данным отчёта Anthropic от августа этого года, Moonshot по активности своих попыток дистилляции ИИ-моделей этого американского стартапа уступает только Alibaba, занимая второе место, а на третьем расположилась китайская DeepSeek. Разработчики из КНР также пытаются получить доступ к передовым вычислительным мощностями на чипах Nvidia, которые располагаются за пределами страны. Поставки многих ИИ-ускорителей американского происхождения в Китай ограничены правилами экспортного контроля США. Китайские разработчики при этом сотрудничают друг с другом. Например, Alibaba договорилась о предоставлении Moonshot AI доступа к примерно 20 000 чипов Nvidia в своей вычислительной инфраструктуре.

В прошлом месяце Anthropic также обвинила Moonshot в том, что та просто направляла тысячи запросов своих пользователей на модели этого американского стартапа, выдавая полученные результаты за свои собственные. При этом ответы ИИ-моделей серии Claude использовались Moonshot для обучения собственных моделей Kimi. Anthropic количество запросов с китайской стороны, предположительно связанных с дистилляцией собственных моделей, измеряет миллионами штук. Раннее обнаружение такой активности позволяет создателям американских моделей блокировать её, сокращая объём извлекаемой китайскими разработчиками информации. Китайские чиновники не раз отвергали обвинения в адрес национальных разработчиков ИИ-систем в неконкурентном поведении.

OpenAI пытается утвердить стандарты обмена информацией о безопасности и угрозах для своих ИИ-моделей на законодательном уровне, и рассчитывает, что к процессу присоединятся и сторонники моделей с открытыми исходными весами, коих немало среди китайских конкурентов. Компания уже делится информацией о подобных угрозах с другими участниками рынка и правительственными структурами США. Для формирования постоянного обмена такой информацией американское антимонопольное законодательство должно быть изменено, как отмечает Bloomberg.

На этой недели американские техногиганты также подписали соглашение о саморегулировании ИИ-отрасли, которое подразумевает создание условий для независимого аудита выпускаемых ИИ-моделей на предмет общественной безопасности. Этот шаг стал ответом на заявления самих разработчиков о необходимости уделять внимание безопасности распространяемых ИИ-моделей, а не просто гнаться за регулярным их обновлением и совершенствованием.

Китай отверг обвинения в злонамеренной дистилляции американских ИИ-моделей

Китайские власти выступили с опровержением заявлений США о том, что разработчики систем искусственного интеллекта из Китая в промышленных масштабах проводят «агрессивную и злонамеренную» деятельность, направленную на копирование возможностей передовых американских систем искусственного интеллекта.

 Источник изображения: Arthur Wang / unsplash.com

Источник изображения: Arthur Wang / unsplash.com

На этой неделе ФБР, АНБ и Агентство по кибербезопасности и защите инфраструктуры (CISA) США выступили с совместным заявлением, в котором заявили, что китайские разработчики ИИ «по меньшей мере с 2024 года» осуществляют дистилляцию передовых американских ИИ-моделей, в том числе Anthropic Claude, OpenAI ChatGPT, Google Gemini и SpaceXAI Grok. В документе упоминаются китайские разработчики ИИ DeepSeek, Alibaba, Moonshot AI, Z.ai, и высказывается предположение, что эту деятельность они осуществляют с ведома правительства Китая.

В Министерстве коммерции Китая обвинения спецслужб США назвали безосновательными и отметили, что Вашингтон стремится установить «монополию в отрасли ИИ». «Если США будут заниматься подавлением китайских ИИ-компаний под предлогом борьбы с дистилляцией, Китай пойдёт на решительные ответные меры», — заявили в ведомстве. Дистилляцию в министерстве охарактеризовали как «распространённую практику», которую применяют многие компании в отрасли ИИ по всему миру, в том числе в США, а обвинения американских властей связали с «тревогой и двойными стандартами».

Китайский МИД призвал США «воздержаться от выдвижения необоснованных обвинений и клеветы» в адрес Китая — будучи крупными державами в области ИИ, две страны должны укреплять сотрудничество. «Развитие ИИ в Китае — результат высокого уровня технологической самостоятельности и мощи. Считаем, что все стороны должны укреплять сотрудничество, чтобы содействовать развитию ИИ — открытому, инклюзивному, взаимовыгодному и нацеленному на общее благо», — добавили в ведомстве.

В сентябре ожидается встреча президента США Дональда Трампа (Donald Trump) и китайского лидера Си Цзиньпина (Xi Jinping), на которой будут обсуждаться вопросы регулирования в сфере ИИ.

Спецслужбы США призвали американских разработчиков ИИ лучше защищать LLM от дистилляции китайскими конкурентами

Для крупных игроков сегмента ИИ, базирующихся главным образом в США, не является секретом высокий интерес к их разработкам со стороны китайских конкурентов. Американские спецслужбы тоже убеждены, что китайцы беспардонным образом «дистиллируют» западные ИИ-модели, чтобы сократить отставание собственных.

 Источник изображения: Unsplash, Towfiqu barbhuiya

Источник изображения: Unsplash, Towfiqu barbhuiya

Тройка американских спецслужб, объединившая НБА, ФБР и CISA (Агентство по кибербезопасности и защите инфраструктуры), на этой неделе выступила с совместным заявлением, обвинив китайские DeepSeek, Moonshot AI, Alibaba Group, MiniMax, StepFun и Z.ai в практике регулярной дистилляции американских ИИ-моделей «в промышленных масштабах» с целью ускорения обучения собственных систем. По версии перечисленных ведомств, данные китайские компании подобной деятельностью занимаются с 2024 года, как минимум.

В отчёте спецслужб приводятся подробности о том, какая из китайских компаний использовала какие американские ИИ-модели для дистилляции, и с какими конкретными целями. Среди прочих упоминается улучшение способности китайских ИИ-моделей решать математические задачи и анализировать программный код. По мнению американских ведомств, подобная активность китайских разработчиков осуществлялась с ведома властей КНР и предусматривала намеренное нарушение существующих ограничений на использование американских моделей.

Представители китайского посольства в США в ответ на запрос Bloomberg данные обвинения назвали «преднамеренной атакой на китайских разработчиков и прогресс в отрасли ИИ». Подобные попытки политизации коммерческой сферы, по словам китайских дипломатов, лишь сдерживают прогресс в мировой отрасли ИИ, а также вредят интересам всех участников рынка.

Американские спецслужбы призвали разработчиков в США усилить меры защиты от дистилляции своих моделей и чаще обмениваться данными друг с другом, которые позволят американским компаниям выявить подобную активность. Правительство США уже рассматривает ряд мер, призванных пресечь подобную практику, и новые свидетельства спецслужб могут ускорить соответствующий законодательный процесс. Нарушителям с китайской стороны могут грозить американские санкции, как признался в июле министр финансов США Скотт Бессент (Scott Bessent).

Китайские ИИ-компании массово «доят» Claude для обучения своих моделей — в ход идут тысячи аккаунтов и даркнет

Расположенные в недружественных США странах компании незаконным образом получают доступ к моделям искусственного интеллекта Claude и обучают на них собственные нейросети для продажи их копий по более низкой цене — этот процесс называется дистилляцией, рассказал CNBC глава отдела по анализу угроз в Anthropic Джейкоб Кляйн (Jacob Klein).

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Сформирована целая незаконная экосистема, направленная на получение доступа к Claude и другим моделям — на платформе компании в промышленных масштабах регистрируются учётные записи. Дистилляция позволяет разработчикам ИИ-моделей использовать результаты работы других компаний для создания конкурентоспособных продуктов за ничтожно малую часть стоимости. Американские власти пока не принимают никаких мер, чтобы не создавать препятствий для отрасли ИИ, чтобы побеждали лучшие и наиболее экономически эффективные решения. Но в Белом доме уже пригрозили привлечь замешанные в этих действиях компании к ответственности.

Китайскую лабораторию ИИ Moonshot в компании Anthropic считают одной из тех, кто копирует её технологии. В июле модель Moonshot Kimi K3 произвела фурор в технологической отрасли — она достаточно мощная, а работа с ней обходится относительно недорого. Кроме того, веса этой модели доступны для всех желающих — её можно свободно использовать и дорабатывать. В дистилляции моделей Claude, по версии Anthropic, были также замешаны китайские лаборатории DeepSeek и MiniMax; компания сообщила и о масштабной атаке со стороны китайского технологического гиганта Alibaba, который регулярно выпускает новые модели Qwen.

Проблема постепенно выходит за рамки обычного нарушения условий использования Claude. Вокруг доступа к американским ИИ-моделям сформировалась целая инфраструктура посредников, которые помогают обходить ограничения, предоставляют большое количество учётных записей, а в некоторых случаях используют скомпрометированные аккаунты и теневые интернет-площадки. Экономический смысл такой схемы очевиден: вместо самостоятельного создания огромного массива высококачественных обучающих данных разработчик может использовать более совершенную модель конкурента в качестве «учителя», значительно сокращая затраты на совершенствование собственного ИИ.

Anthropic рассматривает происходящее и как проблему национальной безопасности США. Компания предупреждает, что дистилляция позволяет китайским разработчикам получать часть возможностей передовых американских ИИ-моделей даже в условиях ограниченного доступа к наиболее производительным ускорителям. Поэтому борьба с подобными схемами становится ещё одним элементом технологического противостояния США и Китая наряду с экспортными ограничениями на поставки передовых чипов.

Американские разработчики пытаются защищать свои платформы от подобных действий, но китайские конкуренты, уверены в компании, обращаются даже к ресурсам в даркнете, где получают данные о взломанных учётных записях на платформах ИИ. Получив доступ к системам Anthropic, злоумышленники начинают активно задавать Claude вопросы и сохранять ответы — таких вопросов задаются не десятки, а тысячи. Ещё один признак дистилляции — создание нескольких тысяч учётных записей для выполнения одной и той же задачи. Полностью остановить эту проблему непросто, признал господин Кляйн, но можно замедлить развитие такой деятельности. Проблема в том, сетует эксперт, что китайские конкуренты в результате создают модели, в которых отсутствуют механизмы защиты, что создаёт серьёзные угрозы.

ByteDance запретила своим исследователям дистиллировать ИИ-модели конкурентов

Основатель китайского технологического гиганта ByteDance запретил исследователям искусственного интеллекта заниматься дистилляцией моделей конкурирующих иностранных компаний. Причиной запрета послужили напряжённые отношения между Вашингтоном и Пекином. Примечательно, что ByteDance не входит в число компаний, которые американские Anthropic и OpenAI обвиняют в использовании своих моделей, что и вызвало угрозы новых санкций со стороны США.

 Источник изображения: ByteDance

Источник изображения: ByteDance

По данным информационного бюллетеня Pekingnology, эта политика действует с 2023 года, и избежание ответных мер со стороны США является потенциальным коммерческим приоритетом. Эти правила вызвали ожесточённые дебаты в ByteDance, чьи лучшие модели были превзойдены более мелкими китайскими лабораториями, что подчёркивает конкурентное давление, с которым сталкивается отрасль.

Пекин стремится к созданию более совершенного ИИ с меньшими вычислительными ресурсами. По мнению аналитиков, американские модели в настоящее время предлагают лучшее соотношение цены и качества, но конвергенция, вероятно, продолжится.

Ранее Anthropic обвинила Moonshot и ещё ряд китайских фирм, включая DeepSeek, MiniMax Group и Alibaba Group, в несанкционированном использовании её модели для дистилляции, а OpenAI выдвинула аналогичные обвинения против DeepSeek. Под дистилляцией подразумевается метод, когда более старая ИИ-модель, «учитель», используется для обучения более новой модели, «ученика», что позволяет передать ей возможности «учителя» с гораздо меньшими затратами, чем при создании оригинальной модели с нуля.

Эта проблема вынудила конкурирующие компании OpenAI, Anthropic и Google к сотрудничеству, чтобы совместными усилиями попытаться пресечь действия китайских конкурентов по предполагаемому использованию данных их передовых моделей для обучения своих.

Anthropic удалила из Claude скрытую защиту от дистилляции ИИ-моделей китайскими разработчиками

Anthropic заявила, что в обновлении Claude Code от 1 июля из приложения удалён добавленный несколько месяцев назад скрытый код, который призван выявлять других разработчиков систем искусственного интеллекта, пытающихся украсть данные её моделей.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

«Этот эксперимент мы запустили в марте, и он был призван предотвращать злоупотребление учётными записями со стороны неавторизованных реселлеров и защитить от дистилляции. С тех пор компания разработала более эффективные меры защиты, и мы на самом деле давно собирались его удалить», — пояснил инженер Anthropic Тарик Шихипар (Thariq Shihipar).

Эксперимент заключался в применении метода стеганографии — сокрытия секретных данных на виду — к контексту системы Claude Code, передаваемому на серверы Anthropic. Код проверял переменную базового URL, используемую для маршрутизации запросов API к шлюзу или прокси-серверу. Если базовый URL переопределяется, код проверяет часовой пояс системы и производит сверку со списком адресов известных китайских лабораторий и других компаний, которые занимаются ИИ, реселлеров учётных записей и доменов шлюзов.

«Claude Code незначительно изменяет системный запрос, используя почти невидимые маркеры Unicode. Классификация прокси/шлюза кодируется в предложение, которое выглядит как обычная фраза на английском. В ней скрывается список доменов в форматах XOR и base64. Функция не вредоносная, но это странный выбор для разработчика, рассчитывающего на доверие», — пояснил эксперт под псевдонимом Thereallo. Компания также использовала средства обнаружения с помощью классификаторов и систем поведенческой идентификации, обмен информацией с другими лабораториями ИИ, контроль доступа и контрмеры, затрудняющие использование ответов модели для воспроизведения её поведения.

С утечкой исходного кода приложения Claude Code стало известно ещё об одном средстве защиты ИИ Anthropic от дистилляции — включении файла Typescript с пометкой «ANTI_DISTILLATION_CC». При установке этой пометки в запросы по API внедряются фиктивные данные, призванные быть опасными при обучении сторонних моделей.

Anthropic обвинила Alibaba в крупнейшей дистилляции Claude для обучения своих ИИ-моделей

Американский разработчик систем искусственного интеллекта Anthropic обвинил китайского технологического гиганта Alibaba в незаконном использовании возможностей модели Claude. Этот инцидент, подчеркнули в Anthropic, стал крупнейшей известной атакой подобного рода на компанию, передаёт Reuters со ссылкой на письмо разработчика.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Действия Alibaba характеризуются как попытка «дистилляции» — обучения менее способной модели ИИ на ответах более способной. Атака производилась в период с 22 апреля по 5 июня и включала более 28,8 млн единиц обмена сообщениями с Claude, которое осуществляли почти 25 000 подставных учётных записей. При помощи дистилляции, говорят в Anthropic, Китай пытается ускорить освоение передовых возможностей Mythos. Кампанию провели операторы, предположительно связанные с Alibaba и её ИИ-отделом Qwen.

Свои соображения Anthropic изложила в письме, которое направила американским сенаторам. Компания выразила поддержку усилиям правительства страны в борьбе с кибератаками, включая партнёрство с частными компаниями, которые специализируются на искусственном интеллекте. В феврале Anthropic выдвинула аналогичные обвинения китайским DeepSeek (150 000 единиц обмена сообщениями), Moonshot AI (3,4 млн) и MiniMax (13 млн). Эти атаки, заявил разработчик, становятся всё более «интенсивными и изощрёнными», требуя соответствующих ответных мер.

Ранее Пентагон добавил Alibaba в список компаний, связанных с китайской армией, а DeepSeek удалось избежать этой участи, потому что ведомство пытается избежать эскалации напряжённости в отношениях с Пекином. И через два дня после отправки Anthropic письма компания была вынуждена закрыть доступ к своим передовым моделям Mythos и Fable.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Control Resonant — дуализм прекрасного. Рецензия 6 ч.
Дорогие видеокарты не остановили покупки игр — Steam показала рекордный сентябрь 6 ч.
ФБР серьёзно взялось за хакеров ShinyHunters, взломавших ФБР — задержан ещё один подозреваемый 6 ч.
Capcom сделает RE Engine игровым движком для разработки с помощью ИИ 11 ч.
ИИ-агент OpenAI узнал о предстоящем отключении из переписки в Slack и планировал своё «спасение» 11 ч.
Microsoft готовит Windows и Surface к чипам Nvidia — подробности раскроют 7 октября 13 ч.
ИИ научился притворяться человеком в видеозвонках — модель Griffin прошла «видеотест Тьюринга» 15 ч.
Gemini 4 хороша в тестах, но буксует в работе — пожаловались сотрудники Google 19 ч.
Apple ужесточит контроль над «полным доступом к диску» в macOS из-за рисков, связанных с ИИ-агентами 22 ч.
Уязвимость в приложении ChatGPT для macOS позволяла хакерам получить доступ к конфиденциальным данным 24 ч.
ASRock Industrial выпустила мини-компьютеры NUC Core 300 Box на платформе Intel Wildcat Lake 9 ч.
JEDEC представила первый в отрасли стандарт для кремниевой фотоники 9 ч.
Купленный с рук Ryzen достался новому владельцу вместе с «баном» в Valorant — античит узнал процессор читера 12 ч.
Samsung запустила серийное производство чипов Exynos 2700, но решение по Galaxy S27 Ultra ещё не принято 16 ч.
Американские iPhone 18 Pro Max теряют связь — обновление не поможет, Apple будет менять смартфоны 19 ч.
Meta предложила всем желающим создавать собственные гаджеты с ИИ-агентом Muse 21 ч.
Роботы лишь через 40 лет смогут конкурировать с людьми всего за 10 % рабочих мест в США 21 ч.
Lian Li выпустила L-образные блоки питания Edge Platinum V2 и Edge Gold V2 мощностью до 1350 Вт, а также концентраторы Edge Hub 22 ч.
QNAP представила управляемые 10GbE-коммутаторы QSW-M5218 с портами 25GbE SFP28 03-10 02:30
Легендарный Kingpin вернётся к экстремальному разгону — оверклокер намекнул на совместный проект с Asus 02-10 23:50