Сегодня 20 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → alibaba cloud

Qwen закрывается: Alibaba сосредоточится на переводе ИИ на коммерческие рельсы

Похоже, что эйфория первых лет бурной экспансии генеративного искусственного интеллекта начинает уступать здоровому прагматизму, и крупные игроки рынка прилагают всё больше усилий по монетизации своих разработок в этой сфере. Для китайского гиганта Alibaba осуществить такой стратегический разворот будет сделать сложнее, с учётом текущей концентрации на моделях с открытым исходным кодом.

 Источник изображения: Unsplash, Markus Winkler

Источник изображения: Unsplash, Markus Winkler

Как отмечает Financial Times, изменения в рыночной стратегии Alibaba в ближайшее время будут связаны с кадровыми перестановками среди руководителей, отвечающих за развитие фирменной экосистемы генеративного ИИ. Команда разработчиков флагманской модели Qwen недавно лишилась двух значимых фигур, которые определяли прежний вектор развития Alibaba в сфере ИИ: Линь Цзюньяна (Lin Junyang) — бывшего технического директора Qwen и Хуэй Биньюаня (Hui Binyuan) — исследователя, специализировавшегося на написании программного кода. Популярность моделей с открытым исходным кодом помогла Alibaba получить множество сторонников среди разработчиков по всему миру, но теперь нужно как-то научиться зарабатывать с помощью имеющегося у китайского гиганта потенциала.

Глава Alibaba Эдди У (Eddie Wu) в прошлом месяце заявил, что в текущих рыночных условиях важно уделять больше внимания концепции «модель как услуга» (MaaS), которая позволяет разработчикам брать с клиентов оплату пропорционально интенсивности использования их моделей. Пока подобный бизнес приносит Alibaba не так много денег. В прошлом месяце Alibaba образовала подразделение Token Hub, которое будет ускорять коммерциализацию разработок в сфере ИИ. Сам Эдди У возглавил новый комитет по ИИ-стратегии, чтобы держать руку на пульсе преобразований. По мнению сторонних экспертов, развитие ИИ-агентов позволило бы Alibaba увеличить свои доходы в профильной сфере.

Руководить стратегией Alibaba в сфере ИИ теперь будет Чжоу Цзинжэнь (Zhou Jingren), который ранее работал техническим директором облачного подразделения Alibaba Cloud. При Цзюньяне команда ИИ-разработчиков Alibaba была слишком сосредоточена на достижении более высокого быстродействия ИИ-моделей в отраслевых бенчмарках, сохраняя приверженность принципу открытого исходного кода, но денег это компании не приносило. Чжоу теперь должен лучше увязать стратегию развития ИИ с целевыми показателями Alibaba в области облачного бизнеса. В этом месяце компания уже представила несколько ИИ-моделей с закрытым исходным кодом. Клиенты смогут работать с этими моделями через облачную инфраструктуру Alibaba. При этом компания продолжит выпускать модели с открытым исходным кодом для некоторых сфер применения. Коллеги характеризуют Чжоу как грамотного технического руководителя, которому вполне по силам будет провести смену вектора в развитии ИИ-бизнеса Alibaba.

Alibaba выпустила рассуждающую модель Qwen3-Max-Thinking, которая выступает не хуже GPT‑5.2‑Thinking и Gemini 3 Pro

Компания Alibaba Cloud открыла публичный доступ к своей новейшей флагманской модели логического рассуждения Qwen3-Max-Thinking. Модель показала производительность на уровне ведущих аналогов, таких как GPT-5.2-Thinking, Claude-Opus-4.5 и Gemini 3 Pro, по результатам 19 бенчмарков.

 Источник изображения: AI

Источник изображения: AI

В официальном блоге компании сообщается, что Qwen3-Max-Thinking достигла улучшений в фактологической точности, сложных логических рассуждениях, следовании инструкциям, соответствии пользовательским предпочтениям и агентских возможностях. Этого удалось добиться за счёт увеличения параметров модели и использования значительных вычислительных ресурсов для обучения с подкреплением (Reinforcement Learning, RL) .

Ключевым нововведением стали адаптивные инструменты и стратегия тестового масштабирования. В отличие от прежнего подхода, когда пользователь вручную выбирал инструменты, Qwen3-Max-Thinking теперь автономно задействует встроенные возможности поиска, памяти и интерпретатора кода прямо в диалоге. Разработчики заявляют, что инструменты поиска и памяти эффективно снижают «галлюцинации», дают доступ к актуальной информации и позволяют давать более персонализированные ответы, а интерпретатор кода позволяет выполнять фрагменты кода для решения сложных задач. Такой подход позволил повысить точность на нескольких специализированных тестах (GPQA, HLE, LiveCodeBench v6, IMO-AnswerBench) при сохранении прежнего объёма вычислений.

 Источник изображения: Alibaba

Источник изображения: Alibaba

По словам компании, модель с адаптивными инструментами уже доступна в Qwen Chat. Также открыт доступ к API через сервис Alibaba Cloud Model Studio, для чего необходимо зарегистрировать аккаунт в Alibaba Cloud, воспользоваться сервисом Model Studio и создать в консоли разработчика API-ключ. API Qwen совместим с протоколом OpenAI API, что позволяет использовать стандартные методы интеграции, а также реализована поддержка протокола Anthropic API, обеспечивающая бесшовную работу с инструментом Claude Code.

Alibaba нашла способ сократить потребность в количестве используемых ускорителей Nvidia на 82 %

Нехватка вычислительных мощностей, присущая динамично развивающемуся рынку искусственного интеллекта, в Китае усугубляется ограничениями на импорт специализированных ускорителей. Разработчики вынуждены заниматься оптимизацией, и Alibaba нашла способ сократить количество необходимых ускорителей Nvidia для работы своих языковых моделей на 82 %.

 Источник изображения: Nvidia

Источник изображения: Nvidia

Как поясняет South China Morning Post, бета-тестирование профильной системы Aegaeon уже проводится одним их подразделений Alibaba Cloud на протяжении более чем трёх месяцев. По информации, представленной Alibaba на мероприятии SOSP в столице Южной Кореи, данная система позволила сократить количество обслуживающих десятки языковых моделей ускорителей Nvidia H20 с 1192 до 213 штук. При этом соответствующие языковые модели используют до 72 млн параметров, как поясняет источник.

Представителям Alibaba в создании такой системы помогали учёные Пекинского университета, которые назвали её «первой попыткой выявить излишние затраты, связанные с одновременным обслуживанием нагрузок с большими языковыми моделями». Провайдеры облачных услуг типа Alibaba сталкиваются с необходимостью одновременного обслуживания тысяч ИИ-моделей, но в сфере инференса наиболее часто используются лишь несколько моделей типа Qwen или DeepSeek, а прочие вызываются довольно редко. Это приводит к нерациональному расходованию ресурсов. В экосистеме Alibaba Cloud, например, до 17,7 % ускорителей выделяются для обработки 1,35 % запросов.

Исследователи во всём мире начали предлагать повысить эффективность использования вычислительных ресурсов за счёт объединения в пулы, когда один GPU обслуживает несколько моделей. Система Aegaeon использует автомасштабирование на уровне токенов, позволяющее GPU переключаться между разными моделями прямо в процессе генерирования токенов. Один GPU в результате способен обрабатывать до семи моделей, тогда как в альтернативно устроенных системах их количество в лучшем случае достигает двух или трёх. Задержки, необходимые на переключение между моделями, при этом сократились на 97 % в случае с Aegaeon.

Alibaba эту систему испытывает на маркетплейсе моделей Bailian, который предлагает модели Qwen корпоративным пользователям. Ускорители Nvidia H20 одноимённой американской компанией были созданы специально для китайского рынка, в апреле они попали под временный запрет на поставку в КНР, но к лету он был снят. Однако, китайские власти начали настоятельно рекомендовать национальным разработчикам отдавать предпочтение местной компонентной базе. В результате позиции Nvidia на китайском рынке передовых чипов для ИИ, по словам руководителя компании, буквально сократились до нуля.

Alibaba представила мощную ИИ-модель Qwen2.5-Max, которая лучше GPT-4o и DeepSeek V3

Alibaba Cloud, облачное подразделение китайской компании Alibaba, анонсировала выпуск обновлённой, крупномасштабной языковой модели Qwen2.5-Max. ИИ-модель основана на архитектуре Mixture-of-Experts (MoE) и обучена на более чем 20 триллионах токенов. Разработчики подчёркивают, что инструмент показал «значительный прогресс в интеллектуальных возможностях» и уже доступен для использования.

 Источник изображения: Alibaba Cloud

Источник изображения: Alibaba Cloud

Новая версия модели отличается улучшенной производительностью и точностью, способна лучше справляться с задачами, требующими глубокого понимания контекста, таких как анализ текста, перевод и генерация контента. «Qwen2.5-Max демонстрирует значительный прогресс в обработке сложных запросов и предоставлении релевантных ответов», — пишет компания на страницах своего блога.

Qwen2.5-Max была протестирована в ряде ключевых бенчмарков, включая MMLU-Pro, LiveCodeBench, LiveBench и Arena-Hard. Модель показала превосходство над DeepSeek V3 в таких тестах, как Arena-Hard, LiveBench и LiveCodeBench, а также продемонстрировала конкурентоспособные результаты в MMLU-Pro. В сравнении с другими ведущими моделями, такими как GPT-4o и Claude-3.5-Sonnet, Qwen2.5-Max также подтвердила свои лидирующие позиции.

 Источник изображения: Alibaba Cloud

Источник изображения: Alibaba Cloud

 Источник изображения: Alibaba Cloud

Источник изображения: Alibaba Cloud

Alibaba Cloud планирует интегрировать Qwen2.5-Max в свои облачные сервисы, что позволит клиентам использовать инструмент для решения широкого спектра задач, включая автоматизацию обработки данных, улучшение взаимодействия с клиентами через чат-ботов и оптимизацию бизнес-процессов.

ИИ-модель уже доступна через сервис Qwen Chat, в котором пользователи могут взаимодействовать с Qwen2.5-Max, тестировать её возможности и экспериментировать с различными функциями. Для разработчиков также открыт программный интерфейс API. Для доступа необходимо зарегистрироваться в Alibaba Cloud, активировать сервис Model Studio и создать API-ключ.

Очки дополненной реальности RayNeo будут использовать ИИ-модели Alibaba

На этой неделе китайский гигант Alibaba продемонстрировал желание косвенно присутствовать на рынке устройств дополненной реальности, заявив о сотрудничестве с гонконгским производителем AR-очков RayNeo. Устройства этой марки будут использовать большие языковые модели Qwen китайской компании Alibaba.

 Источник изображения: RayNeo

Источник изображения: RayNeo

По словам участников проекта, это первый случай сотрудничества разработчиков больших языковых моделей с производителем умных очков в Китае. До этого Alibaba свои языковые модели Qwen подобным образом не использовала, если не считать сотрудничества со стартапом Rokid американского происхождения, основанным бывшим сотрудником Alibaba. Данный альянс был обнародован в ноябре прошлого года, как и сотрудничество Baidu с производителем умных очков Xiaodu, который получил доступ к большой языковой модели Ernie. RayNeo основана в 2021 году производителем дисплеев и телевизоров TCL Electronics Holdings. Компания успела продать более 5000 пар представленных недавно очков дополненной реальности RayNeo Air3. На CES 2025 компания планирует представить пару новых моделей, включая очки с умной камерой, позволяющей распознавать объекты.

Исконно американские компании также не упускают возможности подружить носимые устройства с искусственным интеллектом, в сентябре Meta✴ Platforms представила очки дополненной реальности Orion, а до этого сотрудничала с производителем очков Ray-Ban. Представители Alibaba считают очки дополненной реальности идеальной платформой для использования больших языковых моделей. Дальнейшее сотрудничество с производителями умных очков позволит Alibaba создавать модели с более высоким уровнем кастомизации.

По прогнозам WellsennXR, к 2029 году объёмы продаж очков дополненной реальности вырастут до 55 млн штук в год. В прошлом году ёмкость рынка умных очков достигла $1,93 млрд в денежном выражении. В ближайшие пять лет она ежегодно будет увеличиваться в среднем на 27,3 %, чтобы достичь $8,26 млрд к концу десятилетия.


window-new
Soft
Hard
Тренды 🔥
Авторитетный инсайдер: руководители студий Xbox «абсолютно ненавидят» Game Pass, потому что сервис обесценивает игры 3 ч.
Компании начали проверять кандидатов на дипфейки — хакеры с ИИ всё чаще подсовывают «синтетических сотрудников» 3 ч.
Олдскульная боевая гонка Fumes получила кооператив на 250 игроков, но для него нужен «компьютер NASA» 3 ч.
Спустя 10 месяцев радиомолчания Valve заверила фанатов Team Fortress 2, что всё ещё работает над крупным обновлением для «Манн против машин» 4 ч.
OpenAI признала, что GPT-5.6 иногда удаляет файлы пользователей, но это «честная ошибка» 21 ч.
Alibaba откроет доступ к своим средствам разработки, чтобы бросить вызов Nvidia CUDA 19-07 07:56
Американским чиновникам вновь разрешили устанавливать TikTok на служебных устройствах 19-07 07:24
Ролевая игра Zero Parades: For Dead Spies от авторов культовой Disco Elysium провалилась, в студии пройдут сокращения 19-07 00:47
Новая статья: Assassin’s Creed Black Flag Resynced — это давно должно было случиться. Рецензия 19-07 00:10
По итогам раунда финансирования M рыночная стоимость Databricks вырастет до $188 млрд 18-07 23:16