Сегодня 04 февраля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Сфера ИИ заинтересовалась малыми языковыми моделями — они дешевле и эффективнее больших в конкретных задачах

На рынке ИИ сейчас наблюдается тренд на использование малых языковых моделей (SLM), которые имеют меньше параметров, чем большие языковые модели (LLM), и лучше подходят для более узкого круга задач, пишет журнал Wired.

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

Новейшие версии LLM компаний OpenAI, Meta и DeepSeek имеют сотни миллиардов параметров, благодаря чему могут лучше определять закономерности и связи, что делает их более мощными и точными. Однако их обучение и использование требуют огромных вычислительных и финансовых ресурсов. Например, обучение модели Gemini 1.0 Ultra обошлось Google в 191 миллион долларов. По данным Института исследований электроэнергетики, выполнение одного запроса в ChatGPT требует примерно в 10 раз больше энергии, чем один поиск в Google.

IBM, Google, Microsoft и OpenAI недавно выпустили SLM, имеющие всего несколько миллиардов параметров. Их нельзя использовать в качестве универсальных инструментов, как LLM, но они отлично справляются с более узко определёнными задачами, такими как подведение итогов разговоров, ответы на вопросы пациентов в качестве чат-бота по вопросам здравоохранения и сбор данных на интеллектуальных устройствах. «Они также могут работать на ноутбуке или мобильном телефоне, а не в огромном ЦОД», — отметил Зико Колтер (Zico Kolter), учёный-компьютерщик из Университета Карнеги — Меллона.

Для обучения малых моделей исследователи используют несколько методов, например дистилляцию знаний, при которой LLM генерирует высококачественный набор данных, передавая знания SLM, как учитель даёт уроки ученику. Также малые модели создаются из больших путём «обрезки» — удаления ненужных или неэффективных частей нейронной сети.

Поскольку у SLM меньше параметров, чем у больших моделей, их рассуждения могут быть более прозрачными. Небольшая целевая модель будет работать так же хорошо, как большая, при выполнении конкретных задач, но её будет проще разрабатывать и обучать. «Эти эффективные модели могут сэкономить деньги, время и вычислительные ресурсы», — сообщил Лешем Чошен (Leshem Choshen), научный сотрудник лаборатории искусственного интеллекта MIT-IBM Watson.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая глава, старое название: Blizzard анонсировала перезагрузку Overwatch 2 44 мин.
YouTube включил ИИ-дубляж для всех — в том числе с английского на русский и обратно 2 ч.
Пьяные убийства, съеденные яблоки и акты милосердия: разработчики Kingdom Come: Deliverance 2 раскрыли статистику игроков за год с релиза 2 ч.
Spotify сделал тексты песен понятнее — даже на незнакомых языках и без интернета 3 ч.
«Сделала для Nioh то же, что Elden Ring для Dark Souls»: критики вынесли вердикт Nioh 3 4 ч.
Anthropic пообещала сохранить Claude без рекламы и высмеяла противоположный подход ChatGPT 5 ч.
Взрывной успех Battlefield 6 обеспечил Electronic Arts рекордный квартал 5 ч.
Nintendo анонсировала первую в 2026 году презентацию Nintendo Direct: Partner Showcase — где и когда смотреть 6 ч.
Реалистичный симулятор управления портом Docked от разработчиков RoadCraft и SnowRunner получил дату выхода и предзаказ в российском Steam 7 ч.
ИИ-боты стали новым типом посетителей интернета и генератором трафика — блокировки им не помеха 7 ч.
Microsoft сменила главу отдела безопасности после разноса от властей США 28 мин.
Western Digital готовит жёсткие диски для эпохи ИИ: ёмкостью 100+ Тбайт и кратно быстрее нынешних 2 ч.
Google неполноценно представила Pixel 10a — без цены и характеристик, но с датой предзаказов 3 ч.
В США создали подводный 3D-принтер, печатающий бетоном прямо на морском дне 3 ч.
Утечка раскрыла цены Samsung Galaxy S26, S26+ и S26 Ultra — грядёт подорожание, но возможно не везде 4 ч.
Полностью электрический паром на подводных крыльях установил рекорд, пройдя 300 км за трое суток 5 ч.
Анонсирован игровой смартфон iQOO 15 Ultra с активным кулером, памятью  LPDDR5X Ultra Pro и ценой от $820 5 ч.
AnTuTu опубликовал рейтинг самых быстрых Android-смартфонов и планшетов за январь 5 ч.
Asus выпустит двухрежимный 27-дюймовый монитор ROG Strix XG27UCG Gen2 — 4K при 162 Гц или 1080p при 485 Гц 5 ч.
ИИ-агентов научили отслеживать и исправлять ошибки 3D-печати в реальном времени 5 ч.