Сегодня 13 августа 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Ускорители Nvidia Blackwell более чем в два раза обходят предшественников в обучении больших языковых моделей

По опубликованным некоммерческой организацией MLCommons результатам тестирования различных аппаратных систем при обучении больших языковых моделей становится понятно, что ускорители вычислений Nvidia с архитектурой Blackwell более чем в два раза превосходят по производительности своих предшественников поколения Hopper.

 Источник изображения: Nvidia

Источник изображения: Nvidia

В принципе, об этом в момент анонса архитектуры Blackwell говорила и сама Nvidia, но теперь эти заявления хотя бы подкреплены данными тестов в изложении независимых источников. Применялись языковые модели типа Llama 3.1 405B, которые содержат буквально триллионы параметров и отображают сложность вычислений в сфере искусственного интеллекта на актуальном этапе развития отрасли. Справедливости ради, следует учитывать, что данные для исследования с результатами тестирования своих систем на основе Blackwell компания Nvidia предоставила сама, но представители MLCommons хотя бы не сомневаются в их достоверности.

Из полученных результатов тестирования становится известно, что в удельном выражении каждый чип поколения Blackwell в подобных вычислительных задачах оказывается в два с лишним раза быстрее предшественника поколения Hopper. В конкретной конфигурации система на основе 2496 чипов Blackwell справилась с заданием за 27 минут. Чтобы получить более впечатляющий результат, системе на базе такого же количества чипов Hopper потребовалось более чем в три раза больше времени.

Представители CoreWeave пояснили, что в последнее время в отрасли наблюдается тенденция к разделению крупных вычислительных кластеров на более мелкие подсистемы с небольшим количеством ускорителей, специализирующихся на отдельных подзадачах. Это позволяет ускорять обучение языковых моделей в условиях ограниченности аппаратных ресурсов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Блогер встроил «чит» прямо в руку — электростимуляция ускорила прицеливание в CS2 3 ч.
ИИ-бот Claude теперь может прочитать «Войну и мир» за раз — Anthropic увеличила контекстное меню в 5 раз 4 ч.
ИБ-платформа Security Vision 5 получила множество доработок 5 ч.
Krafton: увольнение руководителей Unknown Worlds спасло Subnautica 2 от судьбы Kerbal Space Program 2 и «непоправимого ущерба всей франшизе» 5 ч.
Chrome начнёт блокировать скрипты для слежки, но только в режиме «Инкогнито» 5 ч.
VK Tech увеличила в I полугодии 2025 года выручку в полтора раза, а количество клиентов выросло более чем втрое 6 ч.
Догоняя X: месячная аудитория Threads превысила 400 млн активных пользователей 7 ч.
Perplexity предложила выкупить Google Chrome за $34,5 млрд — сам стартап стоит почти вдвое меньше 7 ч.
Персонализация поиска Google стала по-настоящему персональной — теперь можно самому выбирать источники 9 ч.
Capcom устроит «эксклюзивный показ» Resident Evil Requiem на Gamescom: Opening Night Live 9 ч.
Новая статья: Обзор складного смартфона Samsung Galaxy Z Flip7: самая изящная раскладушка 4 ч.
Легенда со 133-летней историей собралась на свалку истории — Kodak признала, что скоро не сможет продолжать работу 7 ч.
Samsung выпустила первый телевизор с подсветкой Micro RGB и улучшенной цветопередачей 8 ч.
Учёные придумали невидимые для глаз световые водяные знаки для выявления дипфейков 10 ч.
Анонсирован смартфон Vivo V60 с оптикой Zeiss и ценой от $425 10 ч.
Мобильная графика Arm станет производительнее — в GPU встроят нейронные ускорители 11 ч.
Nvidia представила GeForce RTX 5090D V2: специальный флагман для Китая с урезанной памятью за те же деньги 11 ч.
Жаркая катка: видеокарта GeForce RTX 5090 вспыхнула во время игры в Battlefield 6 12 ч.
Supermicro представила 4U-сервер на базе NVIDIA HGX B200 с СЖО 12 ч.
Tesla запустила редкую рекламу своего автопилота, но пытается скрыть его несовершенство 12 ч.