Сегодня 08 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

PrismML представила не очень большую языковую модель, которая почти не хуже большого оригинала

Лаборатория искусственного интеллекта PrismML представила новую языковую модель, которая имеет достаточно компактные размеры, чтобы работать на обычных ПК и мощных смартфонах. Компания делает ставку на то, что подобные системы не обязательно должны иметь колоссальные размеры.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Новая в линейке языковая модель PrismML Bonsai 2 27B представляет собой версию популярной открытой системы Alibaba Qwen3.8 27B, но в достаточно компактном размере — всего 5,9 Гбайт. Таким образом она легко поместится на ПК или может запускаться даже на флагманском смартфоне. Объём модели сокращён в 9–10 раз по сравнению с оригиналом.

Технология сжатия, которую применяет PrismML, уникальна, утверждает разработчик: созданные компанией модели практически не теряют в показателях производительности в сравнении с оригиналами. Новая Bonsai 2 демонстрирует 98 % от совокупных результатов бенчмарков, которые показала Qwen. Этот показатель выше, чем у выпущенной в марте первой Qwen, которая обеспечивала 95 % оригинала. И если оригинальную скачали 11 млн раз, то компактные модели PrismML — 2,6 млн раз. Таким образом, демонстрируемые стартапом результаты сжатия улучшаются от версии к версии.

Удастся ли когда-нибудь достичь соответствия на все 100 %, вопрос открытый, да он и не имеет особого практического значения. Оригинальные модели не настолько точны, и бенчмарки не настолько идеально отражают реальные задачи, чтобы снижение эффективности на 2 % оказало существенное влияние на работу в реальных условиях. Важным фактором остаётся и программная обвязка.

Внушительных результатов, поясняют в PrismML, удаётся достичь за счёт уменьшения размера весов, составляющих модель. Обычно на каждый требуются 16 бит — стартап же использует тернарные веса, то есть сокращает этот объём до трёх значений: «+1», «0» и «-1». Из-за того, что для каждого веса требуется хранить гораздо меньше данных, то и модель занимает значительно меньше места. Стартап планирует применить этот метод сжатия к ещё более крупным моделям — с сотнями миллиардов параметров; разработчики уверены, что в них будет проще сохранить «интеллект», потому что по мере роста размера модели расширяются возможности для сжатия без потери способностей. Возможно, с ними будет проще добиться соответствия на 100 %.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Gears of War 6 не придётся ждать семь лет 44 мин.
Microsoft радикально обновит Windows — систему заселят ИИ-агентами, которые будут работать рядом с пользователем 3 ч.
Anthropic резко уронила цену ИИ — вышла Claude Haiku 5.5, выполняющая задачи за копейки 4 ч.
Battlefield 6 и Valor Mortis возглавили первую волну новинок Game Pass в октябре, а Clair Obscur: Expedition 33 и A Plague Tale: Requiem подписку скоро покинут 4 ч.
Больше половины создателей Star Wars Zero Company вернулись на работу из вынужденного отпуска — поддержка игры продолжится 5 ч.
Новая статья: Обзор десктопной версии «Яндекс Документов»: кто на новенького? 13 ч.
AMD наделит поддержкой FSR 4 чипы для игровых ноутбуков и портативных приставок до конца 2026 года 13 ч.
ИИ добрался до доменов верхнего уровня — OpenAI и Meta устроили охоту за доменами .agent, .agi и другими зонами 13 ч.
Nvidia RTX Spark выйдет с поддержкой сотен игр — но Call of Duty придётся ждать до 2027 года 14 ч.
Моддер портировал P.T. на ПК с поддержкой трассировки лучей и другими улучшениями — проект оценил сам Кодзима 15 ч.