Сегодня 15 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Alibaba нашла способ сократить потребность в количестве используемых ускорителей Nvidia на 82 %

Нехватка вычислительных мощностей, присущая динамично развивающемуся рынку искусственного интеллекта, в Китае усугубляется ограничениями на импорт специализированных ускорителей. Разработчики вынуждены заниматься оптимизацией, и Alibaba нашла способ сократить количество необходимых ускорителей Nvidia для работы своих языковых моделей на 82 %.

 Источник изображения: Nvidia

Источник изображения: Nvidia

Как поясняет South China Morning Post, бета-тестирование профильной системы Aegaeon уже проводится одним их подразделений Alibaba Cloud на протяжении более чем трёх месяцев. По информации, представленной Alibaba на мероприятии SOSP в столице Южной Кореи, данная система позволила сократить количество обслуживающих десятки языковых моделей ускорителей Nvidia H20 с 1192 до 213 штук. При этом соответствующие языковые модели используют до 72 млн параметров, как поясняет источник.

Представителям Alibaba в создании такой системы помогали учёные Пекинского университета, которые назвали её «первой попыткой выявить излишние затраты, связанные с одновременным обслуживанием нагрузок с большими языковыми моделями». Провайдеры облачных услуг типа Alibaba сталкиваются с необходимостью одновременного обслуживания тысяч ИИ-моделей, но в сфере инференса наиболее часто используются лишь несколько моделей типа Qwen или DeepSeek, а прочие вызываются довольно редко. Это приводит к нерациональному расходованию ресурсов. В экосистеме Alibaba Cloud, например, до 17,7 % ускорителей выделяются для обработки 1,35 % запросов.

Исследователи во всём мире начали предлагать повысить эффективность использования вычислительных ресурсов за счёт объединения в пулы, когда один GPU обслуживает несколько моделей. Система Aegaeon использует автомасштабирование на уровне токенов, позволяющее GPU переключаться между разными моделями прямо в процессе генерирования токенов. Один GPU в результате способен обрабатывать до семи моделей, тогда как в альтернативно устроенных системах их количество в лучшем случае достигает двух или трёх. Задержки, необходимые на переключение между моделями, при этом сократились на 97 % в случае с Aegaeon.

Alibaba эту систему испытывает на маркетплейсе моделей Bailian, который предлагает модели Qwen корпоративным пользователям. Ускорители Nvidia H20 одноимённой американской компанией были созданы специально для китайского рынка, в апреле они попали под временный запрет на поставку в КНР, но к лету он был снят. Однако, китайские власти начали настоятельно рекомендовать национальным разработчикам отдавать предпочтение местной компонентной базе. В результате позиции Nvidia на китайском рынке передовых чипов для ИИ, по словам руководителя компании, буквально сократились до нуля.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Опасная ошибка в macOS позволяла удалённо управлять чужим Mac без пароля 33 мин.
Исход руководителей из OpenAI посеял в компании хаос перед выходом на биржу 3 ч.
Google удалила из «Play Маркета» приложения Ozon 6 ч.
Новая статья: Grim Dawn: Fangs of Asterkarn — мрачный юбилей. Рецензия 14 ч.
Корпоративный боевик Stick It to the Stickman от создателей Broforce и Anger Foot уйдёт с биржи раннего доступа Steam — новый трейлер и дата выхода 1.0 15 ч.
VLC стал запускаться по 30 секунд — разработчики обвинили Windows Defender 17 ч.
ИИ-гонка превратилась в ценовую войну — OpenAI и Anthropic вынуждены дешеветь из-за Китая 17 ч.
Пошаговые тактики до сих пор в моде: более миллиона игроков добавили Star Wars Zero Company в список желаемого 18 ч.
Разработчики Resonance: A Plague Tale Legacy раскрыли системные требования для игры без апскейлеров — GTX 1060 всё ещё в деле 20 ч.
Ветеран Warner Bros. Games: ремастер подарил The Lord of the Rings: War in the North шанс на успех, которого игру лишило соседство со Skyrim 20 ч.
Google переформатировала стратегию Googlebook — сначала флагманы, потом массовый рынок 8 мин.
Samsung работает над новыми полноразмерными наушниками Galaxy H1 15 мин.
Blue Origin построит сразу две стартовые площадки на месте взорванной — для тяжёлой и сверхтяжёлой ракет 38 мин.
Глава SK Group заявил, что из-за памяти всё вокруг будет дорожать 6 ч.
Доля Nvidia в капитале SpaceX оценивалась в $21 млрд в конце второго квартала 6 ч.
OpenAI теперь зарабатывает в корпоративном секторе больше, чем в потребительском 7 ч.
Квартальная выручка Anthropic взлетела в 14 раз до $11,5 млрд 7 ч.
Tencent мгновенно озолотится, сдав в аренду свои GPU, но уверена, что на собственных ИИ-решениях она заработает больше 12 ч.
Dell выпустила 42,5-дюймовый 4K-монитор для видеоконференций со встроенной 8-Мп камерой Sony Starvis 16 ч.
Alphabet сорвала джекпот на SpaceX — вложенные $900 млн превратились почти в $94 млрд 17 ч.