Сегодня 07 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Alibaba выпустила открытую ИИ-модель Qwen3.8-27B, которая запускается локально на ПК

В начале августа китайская Alibaba представила обновлённую флагманскую модель искусственного интеллекта Qwen3.8-Max с 2,4 трлн параметров, из которых 95 млрд остаются активными. Эту модель, предназначенную для работы в облачной инфраструктуре, сначала можно было протестировать только в QwenCloud, но затем компания опубликовала её веса в открытом доступе для всех желающих. А вслед за ней выпустила Qwen3.8-27B размером 27 млрд параметров, и она подходит для запуска на мощном ПК.

 Источник изображений: alibabagroup.com

Источник изображений: alibabagroup.com

Alibaba зарекомендовала себя как лидер в области ИИ с открытыми весами, выступая не хуже стартапов DeepSeek и Moonshot. Одним из первых игроков на рынке открытого ИИ была американская Meta, которая на минувшей неделе выпустила модель Glimmer размером 30 млрд параметров, достаточно компактную для запуска на ПК. Alibaba напомнила гиганту соцсетей, что на этом рынке очень высокая конкуренция. Модель Qwen3.8-27B, утверждает разработчик, обладает «отличными возможностями» в работе с кодом, исследованиях и долгосрочных агентских задачах. Её заявленное качество ответов соответствует моделям, которые в десять раз крупнее по размеру. И это подтвердили опубликованные Alibaba тесты — Qwen3.8-27B проявила себя лучше, чем Meta Muse Glimmer 30B, и не хуже, а то и лучше, чем вышедшая в феврале закрытая Anthropic Opus 4.6.

Это утверждение взялись проверить журналисты ресурса Heise. Оригинальная модель с 32-битными числами с плавающей запятой (FP32) требует значительных ресурсов: не менее 108 Гбайт видеопамяти и около 120 Гбайт дискового пространства для KV-кеша. Квантование модели до FP16 позволяет запускать её на оборудовании с 64 Гбайт видеопамяти, а ещё более компактный квантованный вариант Q5_K_M обходится уже 22 Гбайт памяти — его уже можно запускать на флагманских видеокартах AMD Radeon 7900 XTX и Nvidia GeForce RTX 3090 (Ti), 4090 и 5090. Доступен и вариант с весами NVFP4, оптимизированный для вычислительных блоков Nvidia Blackwell и работающий всего с 16 Гбайт памяти.

В рамках тестирования Qwen3.8-27B в вариантах Q8_0 и NVFP4 запустили в среде Llama.cpp на профессиональной видеокарте Nvidia RTX Pro 6000 Blackwell. Модели поставили задачу разработать полный комплект средств REST API для системы управления запасами с контролем пользователей и авторизацией на основе ролей, не задавая уточняющих вопросов. Квантованная версия NVFP4, которая потребляла вдвое меньше памяти, чем Q8_0, не показала заметного снижения точности или качества ответов.

Qwen3.8-27B написала качественный код — он скомпилировался с первой попытки и поддерживал все запрошенные функции. Качество проекта оказалось неотличимо от результатов работы Anthropic Claude. Модель от Alibaba учла особые аспекты, которые не были упомянуты в задании, в ходе работы находила дубликаты в собственном коде и самостоятельно проводила рефакторинг. Отмечалась некоторая склонность к чрезмерному обдумыванию простых проблем, модель несколько зацикливалась на деталях, в результате чего тратила лишние токены и время. Хотя такое поведение корректируется в настройках.

Запускающиеся на локальных ресурсах модели ИИ имеют преимущества перед облачными. Нет необходимости оформлять подписку и передавать персональные данные сторонним поставщикам. Отсутствуют ограничения, свойственные закрытым моделям Anthropic и OpenAI. Некоторые ограничения есть и у Qwen, но вскоре после выпуска оригинального варианта на Hugging Face появились производные версии, в которых эти ограничения были в значительной степени сняты.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Ведьмак стал вампиром: один из первых модов для The Blood of Dawnwalker подарил главному герою лицо Геральта 35 мин.
Microsoft изменила структуру отчётности и теперь будет сообщать данные об облаке Azure, на которое приходится уже треть выручки 16 ч.
ИИ-агенты потребляют в пять раз больше токенов, чем люди, и это даёт преимущество дешёвым китайским моделям 06-09 08:47
Новая статья: WheelMates — без ветерка. Рецензия 06-09 00:08
Боевик Samson от создателя Just Cause выйдет на консолях до конца сентября после провального релиза на ПК 05-09 22:08
Амбициозная вампирская ролевая игра The Blood of Dawnwalker от ветеранов CD Projekt Red уже стала хитом продаж — миллион копий за два дня 05-09 19:42
Вместо кешбэка и бесплатного Wi-Fi: в Китае начали повсюду раздавать ИИ-токены 05-09 17:20
Суд разрешил конкуренту X использовать слово твит и логотип птицы, но запретил имя Twitter 05-09 14:01
Windows 11 будет сообщать приложениям возраст пользователя 05-09 13:38
В поглощении Hugging Face компанией Nvidia оказалось много символизма — возможно, неслучайного 05-09 13:24
Корейский стартап HyperAccel представил ускорители Bertha для ИИ-инференса 4 мин.
На пять сингапурских операторов ЦОД приходится 98 % инвестиций в ЦОД Юго-Восточной Азии 44 мин.
Наращивание поставок Nvidia Rubin позволит 3-нм техпроцессу TSMC стать самым массовым в денежном выражении уже в этом полугодии 3 ч.
Новая статья: Компьютер месяца, спецвыпуск: выбираем мини-ПК для работы и развлечений в эпоху дефицита чипов памяти 10 ч.
HP представила ноутбуки OmniBook Ultra 16 и X 14 на процессоре Nvidia RTX Spark 16 ч.
CD переживают второе рождение — продажи компакт-дисков в США взлетели почти на 46 % 19 ч.
У Европы появилась своя частная ракета — Isar Aerospace со второй попытки вывела Spectrum на орбиту 19 ч.
В Китае разработан четвероногий робот-поводырь для незрячих людей 06-09 08:21
Xiaomi настолько уверена в своей тяговой батарее, что готова менять сгоревший из-за неё автомобиль на новый 06-09 07:43
Выручка Foxconn на крыльях ИИ-бума в августе выросла на 52 %, и это только начало, как считают в компании 06-09 07:04