Сегодня 16 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia придумала более рациональную HBM — она быстрее обычной на 30 % и экономит до 15 % энергии

Nvidia представила новую технологию в рамках программы NVLink Fusion. NVHBM представляет собой специализированную архитектуру базового кристалла HBM, предназначенную для разработчиков собственных ИИ-ускорителей. По сравнению со стандартной HBM4e она обещает более высокую пропускную способность, меньшее энергопотребление и экономию площади внутри корпуса ускорителя.

 Источник изображений: nvidia.com

Источник изображений: nvidia.com

Как поясняет Nvidia, NVHBM представляет собой специализированный базовый кристалл HBM, разработанный и протестированный совместно с ведущими производителями памяти. Участники программы NVLink Fusion смогут использовать уже готовое решение при создании собственных ускорителей вместо самостоятельной разработки и сертификации подсистемы HBM, что должно сократить сроки вывода новых чипов на рынок.

NVHBM не является заменой самой HBM, а представляет собой один из строительных блоков для специализированных ускорителей партнёров Nvidia. Одним из главных преимуществ технологии должна стать повышенная пропускная способность памяти: компания обещает прирост до 30 % на стек по сравнению со стандартной HBM4e. Для задач, производительность которых ограничена скоростью памяти, это позволит лучше загружать вычислительные блоки и увеличить пропускную способность ускорителя. В частности, при инференсе больших языковых моделей более быстрая передача данных между HBM и вычислительными ядрами позволит увеличить скорость генерации токенов.

Экономия площади достигается за счёт переработанного физического интерфейса памяти. Контроллер перенесён с основного вычислительного кристалла в базовый кристалл трёхмерного стека HBM, а площадь PHY и связанной с ним логики сокращена до 67 % по сравнению со стандартом JEDEC HBM4e. Более узкий интерфейс одновременно упрощает разводку интерпозера. В результате разработчики специализированных ускорителей могут получить до 30 % дополнительной площади основного кристалла для вычислительных блоков и других функций.

Ещё одним преимуществом NVHBM станет снижение энергопотребления памяти на величину до 15 % по сравнению со стандартной HBM4e. Освободившийся энергетический и тепловой бюджет можно использовать для увеличения вычислительной мощности ускорителя или повышения устойчивой производительности при прежнем энергопотреблении. В масштабах крупных ЦОД эффект становится особенно заметным: по расчётам Nvidia, в гипотетическом ЦОД мощностью 1 ГВт с 2000-Вт ускорителями сэкономленной благодаря NVHBM энергии хватило бы для работы ещё 15 000 XPU.

Повышение пропускной способности при одновременном снижении энергопотребления особенно важно для ИИ-ускорителей, которым приходится постоянно перемещать большие объёмы данных, включая веса моделей, KV-кеш и активации. Nvidia утверждает, что сочетание NVHBM с NVLink Fusion за счёт выигрыша в пропускной способности, площади и энергопотреблении способно в совокупности повысить производительность одного XPU на 30 %.

Одним из первых партнёров Nvidia по внедрению NVHBM станет принадлежащая Amazon компания Annapurna Labs. Ускорители следующего поколения Trainium 4 уже получат поддержку NVLink Fusion, а в последующих разработках компания сможет использовать и NVHBM.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Google Переводчик» освоил синхронный перевод офлайн, в том числе на русский — но только на некоторых Pixel 7 мин.
ИИ-агенты смогут доносить друг на друга — для них открыли конфиденциальные «горячие линии» 9 мин.
ЕС запретит детям до 15 лет соцсети и ИИ-ботов без присмотра родителей — платформам грозят штрафы до 6 % оборота 24 мин.
Систему защиту email от Cisco можно взломать с помощью email 39 мин.
TypeSafe AI представила сверхбыструю ИИ-модель Jev не для людей — и она умеет играть в Doom 3 ч.
SiFive и AMD займутся оптимизацией ROCm для RISC-V 4 ч.
Почти все базы данных в США работают на устаревшем ПО — обновиться слишком сложно и дорого 4 ч.
Apple устранила рекордное число уязвимостей в iOS и других программных продуктах 5 ч.
The Rolling Stones, Трэвис Скотт, Future и многие другие: музыканты начали дразнить фанатов тизерами коллаборации с GTA VI 6 ч.
Cloudflare захлопнула дверь перед частью ИИ-ботов на миллионах сайтов 6 ч.
Учёные научились определять погоду на далёких мирах — это поможет искать потенциально обитаемые планеты 13 мин.
На заводе «Москвич» запустили массовый выпуск отечественных «Атомов» 19 мин.
Защита PlayStation 2 пала спустя 27 лет — секретный чип MechaCon пришлось изучать четыре года 31 мин.
AirTrunk и Emergence Quantum изучат криогенное охлаждение в ЦОД 55 мин.
Axelera AI начала поставки ИИ-чипов Europa для высокоэффективного инференса 59 мин.
Tesla вывела Cybercab на дороги без руля и педалей — теперь NHTSA требует доказать, что это законно 3 ч.
МТС запустила гигабитный 5G на российских частотах в пяти городах — но есть нюанс 4 ч.
Производители смартфонов и ноутбуков теперь покупают память вслепую — дефицит не позволяет заранее узнать цену, сроки и объёмы поставок 4 ч.
Anthropic заключила первое соглашение об аренде ИИ ЦОД в Австралии, одного из крупнейших в мире 4 ч.
Micron создала серверные модули памяти RDIMM DDR5-9200 объёмом 512 Гбайт 4 ч.