Сегодня 27 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Сфера ИИ заинтересовалась малыми языковыми моделями — они дешевле и эффективнее больших в конкретных задачах

На рынке ИИ сейчас наблюдается тренд на использование малых языковых моделей (SLM), которые имеют меньше параметров, чем большие языковые модели (LLM), и лучше подходят для более узкого круга задач, пишет журнал Wired.

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

Новейшие версии LLM компаний OpenAI, Meta и DeepSeek имеют сотни миллиардов параметров, благодаря чему могут лучше определять закономерности и связи, что делает их более мощными и точными. Однако их обучение и использование требуют огромных вычислительных и финансовых ресурсов. Например, обучение модели Gemini 1.0 Ultra обошлось Google в 191 миллион долларов. По данным Института исследований электроэнергетики, выполнение одного запроса в ChatGPT требует примерно в 10 раз больше энергии, чем один поиск в Google.

IBM, Google, Microsoft и OpenAI недавно выпустили SLM, имеющие всего несколько миллиардов параметров. Их нельзя использовать в качестве универсальных инструментов, как LLM, но они отлично справляются с более узко определёнными задачами, такими как подведение итогов разговоров, ответы на вопросы пациентов в качестве чат-бота по вопросам здравоохранения и сбор данных на интеллектуальных устройствах. «Они также могут работать на ноутбуке или мобильном телефоне, а не в огромном ЦОД», — отметил Зико Колтер (Zico Kolter), учёный-компьютерщик из Университета Карнеги — Меллона.

Для обучения малых моделей исследователи используют несколько методов, например дистилляцию знаний, при которой LLM генерирует высококачественный набор данных, передавая знания SLM, как учитель даёт уроки ученику. Также малые модели создаются из больших путём «обрезки» — удаления ненужных или неэффективных частей нейронной сети.

Поскольку у SLM меньше параметров, чем у больших моделей, их рассуждения могут быть более прозрачными. Небольшая целевая модель будет работать так же хорошо, как большая, при выполнении конкретных задач, но её будет проще разрабатывать и обучать. «Эти эффективные модели могут сэкономить деньги, время и вычислительные ресурсы», — сообщил Лешем Чошен (Leshem Choshen), научный сотрудник лаборатории искусственного интеллекта MIT-IBM Watson.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Трилогия классических стратегий Empire Earth спустя 25 лет вышла в Steam — в том числе российском 32 мин.
ИИ уличили в расизме при найме на работу 2 ч.
Sony без предупреждения сняла с продажи один из первых эксклюзивов PS5 2 ч.
Безумству храбрых: французский инженер троллит IT-гигантов сатирическими ИИ-нарезками с индюком 2 ч.
Apple усложнит жизнь уличным ворам — iPhone будет автоматически блокироваться, если его вырвут из рук 3 ч.
Пользователи бегут от Google из-за ИИ — поисковик DuckDuckGo резко прирос аудиторией 3 ч.
Сайт для оформления виз в Великобританию случайно опубликовал десятки тысяч паспортов и селфи заявителей 3 ч.
CD Projekt Red в разгар слухов о третьем дополнении к The Witcher 3: Wild Hunt анонсировала юбилейный стрим по «Кровь и вино» 4 ч.
Серверы с ИИ-агентами по всему миру оказались под угрозой из-за ошибки фреймворка Starlette 8 ч.
Смартфоны Motorola уличили в скрытом внедрении партнёрских ссылок Amazon 8 ч.
ByteDance спустит почти всю прошлогоднюю прибыль на ИИ — капзатраты вырастут до $70 млрд 15 мин.
Флагманским смартфонам Samsung предрекли резкое подорожание в июне 28 мин.
ИИ-пузырь раздувается: SK hynix вслед за Micron подорожала до $1 триллиона 29 мин.
Дженсен Хуанг: компании используют ИИ как удобное оправдание для массовых увольнений 30 мин.
Китайцы сделали роботу кисть с почти человеческой гибкостью — пожмёт руку, погладит и обнимет как человек 33 мин.
Китай перейдёт на уличные камеры с ИИ для продвинутой слежки за населением 55 мин.
Минцифры расширило список данных о россиянах, которые операторы должны передавать силовикам 2 ч.
Создание базы NASA на Луне начнётся с трёх миссий, которые состоятся в этом году 2 ч.
Роботакси Tesla сдуваются: на линии осталось всего 20 машин, несмотря на громкие обещания Маска 2 ч.
Дефицит памяти взвинтит цены на смартфоны — рынок откатится к уровню 2013 года 3 ч.