Сегодня 29 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Сфера ИИ заинтересовалась малыми языковыми моделями — они дешевле и эффективнее больших в конкретных задачах

На рынке ИИ сейчас наблюдается тренд на использование малых языковых моделей (SLM), которые имеют меньше параметров, чем большие языковые модели (LLM), и лучше подходят для более узкого круга задач, пишет журнал Wired.

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

Новейшие версии LLM компаний OpenAI, Meta и DeepSeek имеют сотни миллиардов параметров, благодаря чему могут лучше определять закономерности и связи, что делает их более мощными и точными. Однако их обучение и использование требуют огромных вычислительных и финансовых ресурсов. Например, обучение модели Gemini 1.0 Ultra обошлось Google в 191 миллион долларов. По данным Института исследований электроэнергетики, выполнение одного запроса в ChatGPT требует примерно в 10 раз больше энергии, чем один поиск в Google.

IBM, Google, Microsoft и OpenAI недавно выпустили SLM, имеющие всего несколько миллиардов параметров. Их нельзя использовать в качестве универсальных инструментов, как LLM, но они отлично справляются с более узко определёнными задачами, такими как подведение итогов разговоров, ответы на вопросы пациентов в качестве чат-бота по вопросам здравоохранения и сбор данных на интеллектуальных устройствах. «Они также могут работать на ноутбуке или мобильном телефоне, а не в огромном ЦОД», — отметил Зико Колтер (Zico Kolter), учёный-компьютерщик из Университета Карнеги — Меллона.

Для обучения малых моделей исследователи используют несколько методов, например дистилляцию знаний, при которой LLM генерирует высококачественный набор данных, передавая знания SLM, как учитель даёт уроки ученику. Также малые модели создаются из больших путём «обрезки» — удаления ненужных или неэффективных частей нейронной сети.

Поскольку у SLM меньше параметров, чем у больших моделей, их рассуждения могут быть более прозрачными. Небольшая целевая модель будет работать так же хорошо, как большая, при выполнении конкретных задач, но её будет проще разрабатывать и обучать. «Эти эффективные модели могут сэкономить деньги, время и вычислительные ресурсы», — сообщил Лешем Чошен (Leshem Choshen), научный сотрудник лаборатории искусственного интеллекта MIT-IBM Watson.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Разработчики Greedfall и Steelrising подтвердили закрытие студии — DLC для Greedfall: The Dying World выпустит Nacon, «а потом всё» 6 мин.
Microsoft встроит ИИ в «Часы» в Windows 11 — и превратит их в приложение для повышения концентрации 2 ч.
«Один из лучших месяцев в истории»: Sony приятно удивила фанатов майской подборкой игр PS Plus 2 ч.
Новый трейлер подтвердил дату выхода Phonopolis — авангардной головоломки от создателей Samorost и Machinarium 3 ч.
Google TV получит новые ИИ-функции, а на главном экране появятся YouTube Shorts 3 ч.
Во время майских праздников в Москве могут отключить мобильный интернет 3 ч.
Симулятор выживания в заброшенной сибирской деревне Midnight Watcher: Village получил атмосферный трейлер 3 ч.
Microsoft опубликовала исходники 86-DOS и PC-DOS 1.00 с дополнительными материалами — распечатки пылились в гараже больше 45 лет 4 ч.
Представлен десктопный ИИ-агент Amazon Quick — он выполняет часовые задачи за минуты 4 ч.
Спустя почти два года пираты всё-таки взломали Denuvo в Black Myth: Wukong — гипервизор не требуется 4 ч.
Китайские учёные преуспели в превращении углекислого газа в керосин — к этому подтолкнул иранский кризис 6 мин.
Motorola представила смартфон Moto G87 c Dimensity 6400 и 200-Мп камерой за €399 9 мин.
Ozon разрабатывает собственный WAF 25 мин.
Motorola выпустила глобальную версию Razr 70 Plus со Snapdragon 8s Gen 3, парой 50-Мп камер и батареей на 4500 мА·ч 26 мин.
Motorola представила смартфоны-раскладушки Razr 70 и Razr 70 Ultra — изменений мало, но цены выше 51 мин.
Мониторы Philips Evnia получили функцию AmbiScape для синхронизации умных светильников с играми 2 ч.
Поставки кремниевых пластин в первом квартале 2026 года выросли на 13 % благодаря буму ИИ 2 ч.
Китай пригрозил ответными мерами в случае запрета в ЕС оборудования Huawei 3 ч.
Caviar представила четвёрку розовых iPhone 17 Pro и Pro Max, украшенных золотом и бриллиантами 4 ч.
Мобильный чип Google Tensor G6 получит передовой CPU и древнюю графику, если слухи верны 4 ч.