Сегодня 06 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Сфера ИИ заинтересовалась малыми языковыми моделями — они дешевле и эффективнее больших в конкретных задачах

На рынке ИИ сейчас наблюдается тренд на использование малых языковых моделей (SLM), которые имеют меньше параметров, чем большие языковые модели (LLM), и лучше подходят для более узкого круга задач, пишет журнал Wired.

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

Новейшие версии LLM компаний OpenAI, Meta и DeepSeek имеют сотни миллиардов параметров, благодаря чему могут лучше определять закономерности и связи, что делает их более мощными и точными. Однако их обучение и использование требуют огромных вычислительных и финансовых ресурсов. Например, обучение модели Gemini 1.0 Ultra обошлось Google в 191 миллион долларов. По данным Института исследований электроэнергетики, выполнение одного запроса в ChatGPT требует примерно в 10 раз больше энергии, чем один поиск в Google.

IBM, Google, Microsoft и OpenAI недавно выпустили SLM, имеющие всего несколько миллиардов параметров. Их нельзя использовать в качестве универсальных инструментов, как LLM, но они отлично справляются с более узко определёнными задачами, такими как подведение итогов разговоров, ответы на вопросы пациентов в качестве чат-бота по вопросам здравоохранения и сбор данных на интеллектуальных устройствах. «Они также могут работать на ноутбуке или мобильном телефоне, а не в огромном ЦОД», — отметил Зико Колтер (Zico Kolter), учёный-компьютерщик из Университета Карнеги — Меллона.

Для обучения малых моделей исследователи используют несколько методов, например дистилляцию знаний, при которой LLM генерирует высококачественный набор данных, передавая знания SLM, как учитель даёт уроки ученику. Также малые модели создаются из больших путём «обрезки» — удаления ненужных или неэффективных частей нейронной сети.

Поскольку у SLM меньше параметров, чем у больших моделей, их рассуждения могут быть более прозрачными. Небольшая целевая модель будет работать так же хорошо, как большая, при выполнении конкретных задач, но её будет проще разрабатывать и обучать. «Эти эффективные модели могут сэкономить деньги, время и вычислительные ресурсы», — сообщил Лешем Чошен (Leshem Choshen), научный сотрудник лаборатории искусственного интеллекта MIT-IBM Watson.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Китайские власти не смогли заблокировать мессенджер Bitchat, поэтому заставили Apple его удалить 3 мин.
Симулятор кошачьего завода «Мурзавод» от создателей «Русы против ящеров» уже можно попробовать — в Steam стартовало закрытое тестирование 9 мин.
В РКН пожаловались на резкий скачок DDoS-атак на государственные информресурсы в феврале–марте 2 ч.
«Это только начало»: авторы Arc Raiders сделали крафтинг удобнее и пообещали впредь реагировать на жалобы игроков 2 ч.
Список достижений Starfield раскрыл неанонсированные секреты дополнения Terran Armada 4 ч.
В Google Play появилась функция поиска по отзывам 4 ч.
Британцы пытаются «заманить» к себе Anthropic после конфликта с Пентагоном 5 ч.
Свежий трейлер аркадного авиасимулятора Ace Combat 8: Wings of Theve показал, какой путь серия проделала за 30 лет 5 ч.
Объём мирового рынка неооблаков достигнет $400 млрд к 2031 году 5 ч.
Amazon распорядилась сделать сериал Mass Effect «более привлекательным для негеймеров» 7 ч.
Развитие ИИ в США теперь зависит от электрооборудования из Китая, а санкции и пошлины только усугубляют дело 2 ч.
Tesla отделалась от расследования по поводу одной из функций автопилота, просто обновив ПО 3 ч.
Тайвань заподозрил ещё 11 китайских компаний в агрессивном переманивании чиповых специалистов 4 ч.
Dell’Oro Group: мировая телеком-отрасль снизит затраты в 2026 году 5 ч.
Xiaomi представила 300-Гц монитор за $108 — Redmi G25 300 Гц на 24,5-дюймовой матрице Fast IPS 5 ч.
Advantech готовит MIO-5356 — один из первых одноплатных компьютеров на платформе Intel Wildcat Lake 6 ч.
IDC: расходы на европейском ИИ-рынке достигнут $290 млрд к 2029 году 6 ч.
Данные миссии ESA Gaia помогли найти 87 звёздных потоков, которые ускользали от астрономов 7 ч.
OpenAI рассчитывает разогнать годовую выручку к $300 млрд уже через четыре года 7 ч.
Россияне стали покупать меньше смартфонов: первый квартал завершился падением спроса на 6 % 8 ч.