Сегодня 18 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

PrismML представила не очень большую языковую модель, которая почти не хуже большого оригинала

Лаборатория искусственного интеллекта PrismML представила новую языковую модель, которая имеет достаточно компактные размеры, чтобы работать на обычных ПК и мощных смартфонах. Компания делает ставку на то, что подобные системы не обязательно должны иметь колоссальные размеры.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Новая в линейке языковая модель PrismML Bonsai 2 27B представляет собой версию популярной открытой системы Alibaba Qwen3.8 27B, но в достаточно компактном размере — всего 5,9 Гбайт. Таким образом она легко поместится на ПК или может запускаться даже на флагманском смартфоне. Объём модели сокращён в 9–10 раз по сравнению с оригиналом.

Технология сжатия, которую применяет PrismML, уникальна, утверждает разработчик: созданные компанией модели практически не теряют в показателях производительности в сравнении с оригиналами. Новая Bonsai 2 демонстрирует 98 % от совокупных результатов бенчмарков, которые показала Qwen. Этот показатель выше, чем у выпущенной в марте первой Qwen, которая обеспечивала 95 % оригинала. И если оригинальную скачали 11 млн раз, то компактные модели PrismML — 2,6 млн раз. Таким образом, демонстрируемые стартапом результаты сжатия улучшаются от версии к версии.

Удастся ли когда-нибудь достичь соответствия на все 100 %, вопрос открытый, да он и не имеет особого практического значения. Оригинальные модели не настолько точны, и бенчмарки не настолько идеально отражают реальные задачи, чтобы снижение эффективности на 2 % оказало существенное влияние на работу в реальных условиях. Важным фактором остаётся и программная обвязка.

Внушительных результатов, поясняют в PrismML, удаётся достичь за счёт уменьшения размера весов, составляющих модель. Обычно на каждый требуются 16 бит — стартап же использует тернарные веса, то есть сокращает этот объём до трёх значений: «+1», «0» и «-1». Из-за того, что для каждого веса требуется хранить гораздо меньше данных, то и модель занимает значительно меньше места. Стартап планирует применить этот метод сжатия к ещё более крупным моделям — с сотнями миллиардов параметров; разработчики уверены, что в них будет проще сохранить «интеллект», потому что по мере роста размера модели расширяются возможности для сжатия без потери способностей. Возможно, с ними будет проще добиться соответствия на 100 %.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Демоверсия хардкорного скоростного шутера Hmur от российского разработчика-одиночки вышла в Steam, но ненадолго 17 мин.
PrismML представила не очень большую языковую модель, которая почти не хуже большого оригинала 34 мин.
Google учредила DeepMind Institute для обсуждения проблем сильного ИИ 48 мин.
Gears of War: E-Day ушла на золото и получила окончательные системные требования — без трассировки лучей, но с апскейлерами 50 мин.
Google CC стал семейным ИИ-секретарём — он собирает письма, чеки и документы и превращает их в планы 2 ч.
Глава Take-Two сравнил GTA VI с Барби 3 ч.
Anthropic заявила, что ИИ теперь руководит 26 % деятельности по разработке и исследованиям внутри компании 4 ч.
Несколько ИИ-агентов научились работать параллельно в обновлённом Claude Code Projects 7 ч.
Microsoft думала о бездисковом Xbox ещё в 2011 году — теперь идея воплотилась в «оцифровке» дисков 13 ч.
Спустя шесть лет после Dreams разработчики LittleBigPlanet и Tearaway готовятся выйти из тени — первые подробности новой игры Media Molecule 14 ч.
У iPhone 18 Pro Max насчитали как минимум 18 функций, которые не будут работать в России 13 мин.
Toyota создаст армию из 400 000 роботов — они будут работать на заводах и обучать людей 40 мин.
Curiosity отметил 5000 солов на Марсе и прислал NASA открытку, на которой встретились утро и вечер 54 мин.
Yadro инвестировала 1,2 млрд рублей в разработку двухдиапазонного радиомодуля для сетей LTE и 5G 3 ч.
Новая фабрика Samsung в Техасе наконец начала делать 2-нм чипы — первым крупным заказчиком стала Tesla 3 ч.
NASA неожиданно решило реанимировать многострадальный Starliner — к этому толкают планы SpaceX свернуть Crew Dragon 3 ч.
Samsung хочет больше модулей DDR5, но ей негде их производить — на помощь придут сторонние компании 4 ч.
Глава Nvidia уверен, что в следующем году компания сможет продать вдвое больше чипов 7 ч.
Crusoe, застройщик ЦОД OpenAI Stargate, привлекла $3,9 млрд с оценкой в $30,9 млрд и сделала ставку на малые модульные дата-центры 11 ч.
Новая статья: Обзор Full HD IPS-монитора MSI PRO MAX 271PHW E14: гни свою линию 12 ч.