Сегодня 28 марта 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Сфера ИИ заинтересовалась малыми языковыми моделями — они дешевле и эффективнее больших в конкретных задачах

На рынке ИИ сейчас наблюдается тренд на использование малых языковых моделей (SLM), которые имеют меньше параметров, чем большие языковые модели (LLM), и лучше подходят для более узкого круга задач, пишет журнал Wired.

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

Новейшие версии LLM компаний OpenAI, Meta и DeepSeek имеют сотни миллиардов параметров, благодаря чему могут лучше определять закономерности и связи, что делает их более мощными и точными. Однако их обучение и использование требуют огромных вычислительных и финансовых ресурсов. Например, обучение модели Gemini 1.0 Ultra обошлось Google в 191 миллион долларов. По данным Института исследований электроэнергетики, выполнение одного запроса в ChatGPT требует примерно в 10 раз больше энергии, чем один поиск в Google.

IBM, Google, Microsoft и OpenAI недавно выпустили SLM, имеющие всего несколько миллиардов параметров. Их нельзя использовать в качестве универсальных инструментов, как LLM, но они отлично справляются с более узко определёнными задачами, такими как подведение итогов разговоров, ответы на вопросы пациентов в качестве чат-бота по вопросам здравоохранения и сбор данных на интеллектуальных устройствах. «Они также могут работать на ноутбуке или мобильном телефоне, а не в огромном ЦОД», — отметил Зико Колтер (Zico Kolter), учёный-компьютерщик из Университета Карнеги — Меллона.

Для обучения малых моделей исследователи используют несколько методов, например дистилляцию знаний, при которой LLM генерирует высококачественный набор данных, передавая знания SLM, как учитель даёт уроки ученику. Также малые модели создаются из больших путём «обрезки» — удаления ненужных или неэффективных частей нейронной сети.

Поскольку у SLM меньше параметров, чем у больших моделей, их рассуждения могут быть более прозрачными. Небольшая целевая модель будет работать так же хорошо, как большая, при выполнении конкретных задач, но её будет проще разрабатывать и обучать. «Эти эффективные модели могут сэкономить деньги, время и вычислительные ресурсы», — сообщил Лешем Чошен (Leshem Choshen), научный сотрудник лаборатории искусственного интеллекта MIT-IBM Watson.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Slay the Spire 2 — свободное время, прощай! Предварительный обзор 42 мин.
Новая статья: Обзор нового сезона Warface «Стальные кварталы»: брутальность в каждой катке! 3 ч.
В Telegram обнаружена крайне опасная уязвимость нулевого дня, но детали держат в секрете 4 ч.
Инсайдеры: легендарная The Legend of Zelda: Ocarina of Time получит ремейк для Nintendo Switch 2, причём уже скоро 6 ч.
Nacon выставила на продажу две внутренние студии, включая разработчиков Greedfall и Steelrising 8 ч.
Windows сбоит в три раза чаще macOS — по зависаниям разрыв в 7,5 раза 8 ч.
Слухи: экономия Ubisoft может поставить под угрозу крупнейшие игры компании, включая новую Ghost Recon 9 ч.
Ветеран Microsoft рассказал, как Windows 95 легко и незаметно боролась с нерадивыми разработчиками 10 ч.
Google представила ИИ для создания приложений для XR-гарнитур менее чем за минуту 10 ч.
В Telegram появился ИИ-переписчик сообщений 11 ч.
Meta построит ещё семь газовых электростанций для своего гигантского ИИ ЦОД Hyperion 3 ч.
Meta построит сразу семь газовых ТЭС на 5,2 ГВт, чтобы не отстать в гонке ИИ 4 ч.
SoftBank одолжила $40 млрд на год, чтобы инвестировать их в OpenAI 4 ч.
«Не хотите ускорители? Возьмите хотя бы сеть!» — NVIDIA открыла свои ИИ-стойки для чужих чипов 6 ч.
Вебинар T1 Облако и Curator. Выбор без выбора: почему защита от DDoS-атак — не опция, а необходимость 7 ч.
Глава Nvidia выступит на Computex 2026 — ожидается анонс ноутбучного процессора Nvidia N1 8 ч.
Xiaomi представила смартфон Redmi 15A 5G за $137 и пообещала ему обновления Android до 2032 года 8 ч.
Опубликован свежий «портрет» самой старой из известных сверхновых — она взорвалась в 185 году нашей эры 8 ч.
Представлен смартфон Tecno Spark 50 5G с чипом Dimensity 6400 и батареей на 6500 мА·ч за $179 9 ч.
Первый полёт российского корабля нового поколения «Орёл» перенесли на 2028 год 10 ч.