Сегодня 25 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

ИИ-ускорители упёрлись в предел скорости HBM, и эта проблема пострашнее дефицита памяти

По оценкам представителей отрасли, современные ИИ-ускорители в своём развитии достигли того этапа, когда пропускная способность интерфейса памяти становится узким местом на пути дальнейшего масштабирования быстродействия. Дефицит памяти или её объём в этом отношении уходят на второй план, и устранение этого барьера главным образом зависит от разработчиков GPU и больших языковых моделей.

 Источник изображения: Nvidia

Источник изображения: Nvidia

По словам сооснователя Majestic Labs Ша Рабии (Sha Rabii), на которого ссылается CNBC, если непосредственно ускорители вычислений в последние годы продвинулись в своём быстродействии весьма значительно, сопутствующая им память стала не особо быстрее. По сути, именно производительность памяти ограничивает сейчас дальнейший рост быстродействия больших языковых моделей. При этом переход к инференсу увеличит потребности в объёме памяти, так что спрос на неё будет расти очень быстро. В любом случае, чем больше в инфраструктуре ИИ памяти, тем большее количество клиентов она способна обслуживать в единицу времени. О необходимости наращивать объёмы выпуска памяти на CES 2026 говорил и основатель Nvidia Дженсен Хуанг (Jensen Huang). Он даже отметил, что покупатели игровых решений компании типа видеокарт и консолей «обижены» на отрасль ИИ, поскольку дефицит памяти толкает цены вверх даже в указанных смежных сегментах рынка.

Даже запланированный AMD и Nvidia переход на использование памяти типа HBM4 не позволит полностью решить проблему пропускной способности. Память этого семейства всё равно ограничена в количестве задействованных каналов и высоте стека микросхем, не говоря уже о ширине интерфейса. Пропускная способность вычислительных систем могла бы масштабироваться гораздо эффективнее, если бы не свойственные HBM ограничения. Наращивать количество вычислительных блоков в составе GPU в таких условиях не имеет особого смысла, ибо память не будет успевать передавать все данные при вычислительных нагрузках, имеющих отношение как к обучению больших языковых моделей, так и инференсу.

Доступные разработчикам компонентов методы упаковки чипов также выступают в роли специфического ограничивающего фактора, в условиях высокого спроса профильные мощности сильно загружены, усиливая дефицит скоростной памяти и повышая расходы производителей.

На архитектурном уровне разработчики пытаются изучать альтернативы типа осуществления вычислений прямо внутри микросхем памяти (PIM), увеличения плотности компоновки микросхем в составе стека памяти, а также применения в многокристальных решениях прогрессивных интерфейсов типа UCIe, которые позволяют не только увеличить эффективную полосу пропускания, но и снизить задержки при работе с данными. Темпы дальнейшего масштабирования инфраструктуры ИИ будут зависеть от прогресса в сфере внедрения более скоростной памяти.

HBM4 предложит прирост быстродействия в полтора раза относительно HBM3E, позволяя через свою более широкую 2048-разрядную шину передавать до 2 терабайт данных в секунду. К 2027 году на арену выйдет память типа HBM4E, которая потенциально увеличить скорость передачи информации ещё в полтора раза. Внедрение интерфейса CXL также должно способствовать повышению эффективности обмена данными между компонентами вычислительных систем. В части памяти переход к CXL обеспечит увеличение степени загрузки на 50 %, а также снижение энергопотребления на величину до 20–30 %. Появление новых методов трёхмерной компоновки памяти тоже должно способствовать повышению производительности и снижению энергопотребления.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про технологии и рынок it

Источник:


window-new
Soft
Hard
Тренды 🔥
Издатель Atomic Heart и Warhammer 40,000: Space Marine 2 поможет ветеранам Forza Horizon с выпуском амбициозной сюжетной гонки Clutch 2 ч.
Реклама в ChatGPT стала доступна для европейских пользователей из 31 страны 4 ч.
Календарь релизов 24–30 августа: Resonance: A Plague Tale Legacy и Star Wars Zero Company 11 ч.
NVIDIA выплатит Poolside за лицензию $6 млрд и получит более ста его специалистов, но поглощением эту сделку называть отказывается 14 ч.
Hugging Face отказалась от денег Nvidia и теперь рассматривает продажу за $13 млрд 15 ч.
The Witcher 4 выйдет в 2028 году — это «самая большая, смелая и амбициозная игра» в истории CD Projekt Red 15 ч.
«Это пустяки»: ветеран Rockstar сравнил утечки GTA VI с секс-скандалом вокруг GTA: San Andreas 17 ч.
После критики фанатов вампирская ролевая игра The Blood of Dawnwalker от ветеранов CD Projekt Red всё-таки получит поддержку 60 кадров/с на консолях 17 ч.
Alibaba выпустила Wan3.0 — новую версию генератора 30-секундных видео 18 ч.
Авторитетный инсайдер подтвердил продолжение Ori and the Will of the Wisps, а создатель серии назвал слухи об Ori 3 «полной чушью» 21 ч.
Apple может представить обновлённый Mac mini до конца августа 2 ч.
SpaceX начнёт выводить на орбиту космические ЦОД в четвёртом квартале следующего года 3 ч.
Nvidia заявила, что ускорители Groq 3 LPX начали массово выпускаться и выйдут на рынок в этом году 4 ч.
Raspberry Pi выпустила руководство по сборке собственного мини-ПК 4 ч.
Intel рассказала о технических сложностях, стоявших при разработке мобильных процессоров Wildcat Lake 6 ч.
LG оценила 24,5-дюймовый игровой IPS-монитор UltraGear 25G590B с Full HD и 1000 Гц в $1000 9 ч.
Intel раскрыла устройство Crescent Island — ИИ-ускорителя с огромным объёмом дешёвой памяти 10 ч.
Новая статья: Обзор и тест процессорного кулера MSI MAG CoreFrozr AA13: просто, недорого, симпатично 10 ч.
Продажи телевизоров Samsung и TCL растут вопреки дорогой памяти — рынок готовится к новой битве технологий 14 ч.
В контрабанде ИИ-ускорителей в Китай оказался замешан топ-менеджер Nvidia — теперь ему грозит 5 лет тюрьмы 15 ч.