Сегодня 06 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → intel gaudi2

Intel также будет вынуждена ограничить поставки ускорителей вычислений в Китай

Требования американских властей к допустимому быстродействию ускорителей вычислений, разрешённых к поставке в Китай, в большинстве случаев формулируются в виде каких-то измеримых характеристик, но редко становятся известны общественности. Компания Intel, как стало известно на этой неделе, также столкнётся с ограничениями на поставку ускорителей Gaudi в Китай.

 Источник изображения: Intel

Источник изображения: Intel

Переживающего не самый простой период в своей истории процессорного гиганта сейчас сложно назвать заметным игроком в сегменте ускорителей вычислений для систем искусственного интеллекта. Из тех 10 % рынка, которые оставляет прочим участникам рынка компания Nvidia, основная часть приходится на долю AMD, а роль Intel в данном виде коммерческой деятельности вообще минимальна. К слову, данное упущение не осталось без внимания нового генерального директора Intel Лип-Бу Тана (Lip-Bu Tan), и он пообещал укреплять позиции компании в сегменте ускорителей для систем ИИ.

По данным Financial Times, компания Intel уже уведомила своих китайских клиентов о необходимости получить экспортную лицензию на поставку в КНР своих ускорителей вычислений, обладающих уровнем быстродействия выше заявленных властями США пределов. Так, для пропускной способности памяти установлен порог в 1400 Гбайт/с, для пропускной способности интерфейсов — 1100 Гбайт/с, при этом в совокупности эти величины не могут превышать 1700 Гбайт/с. Как и ускорители Nvidia H20, решения Intel семейства Gaudi заведомо попадают под ограничения.

Nvidia уже оценила свои возможные потери от новых санкций США в данной сфере в $5,5 млрд по итогам только первого квартала. По неофициальным данным, по итогам всего текущего года эти потери легко превысят $10 млрд. Компания AMD пока довольствуется более скромными оценками ущерба на уровне $800 млн, а Intel свои расчёты на эту тему пока не опубликовала. Упоминание о необходимости получить экспортные лицензии для поставки ускорителей в Китай является лишь формальностью. На практике у всех трёх компаний крайне мало шансов подобными лицензиями обзавестись.

ИИ-ускоритель Intel Gaudi2 оказался на 55 % быстрее Nvidia H100 в тестах Stable Diffusion 3, но есть нюанс

Компания Stability AI, разработчик популярной модели генеративного ИИ Stable Diffusion, сравнила производительность модели Stable Diffusion 3 на популярных ускорителях вычислений для центров обработки данных, включая Nvidia H100 Hopper, A100 Ampere и Intel Gaudi2. По утверждению Stability AI, Intel Gaudi2 продемонстрировал производительность примерно на 56 % выше, чем Nvidia H100.

 Источник изображения: Intel

Источник изображения: Intel

В отличие от H100, который представляет собой суперскалярный графический процессор с тензорными CUDA-ядрами, Gaudi2 специально спроектирован для ускорения генеративного ИИ и больших языковых моделей (LLM). В тестах приняли участие пары кластеров, которые в сумме обеспечивали по 16 тех или ускорителей, а проводились тесты с постоянным размером батча (число тренировочных объектов) в 16 на каждый ускоритель (всего 256). Системы на Intel Gaudi2 оказались способны генерировать 927 изображений в секунду по сравнению с 595 изображениями для ускорителей H100 и 381 изображением в секунду для массива A100.

 Источник изображения: Stability AI

Источник изображения: Stability AI

При увеличении количества кластеров до 32, а числа ускорителей до 256 и размере батча 16 на ускоритель (общий размер 4096), массив Gaudi2 генерирует 12 654 изображения в секунду или 49,4 изображения в секунду на ускоритель, по сравнению с 3992 изображениями в секунду или 15,6 изображениями в секунду на устройство у массива A100 Ampere.

 Источник изображения: Nvidia

Источник изображения: Nvidia

Необходимо отметить, что производительность ускорителей ИИ измерялась с использованием фреймворка PyTorch, а в случае применения оптимизации TensorRT чипы A100 создают изображения до 40 % быстрее, чем Gaudi2. Тем не менее, исследователи Stability AI ожидают, что при дальнейшей оптимизации Gaudi2 превзойдёт A100. Компания полагает, что более быстрый интерконнект и больший объем памяти (96 Гбайт) делают решения Intel вполне конкурентоспособными и планирует использовать ускорители Gaudi2 в Stability Cloud.

 Источник изображения: techpowerup.com

Источник изображения: techpowerup.com

По сообщению Stability AI, в более ранних тестах модели Stable Diffusion XL с использованием фреймворка PyTorch ускоритель Intel Gaudi2 генерирует при 30 шагах изображение размером 1024 × 1024 за 3,2 секунды по сравнению с 3,6 секунды для PyTorch на Nvidia A100 и 2,7 секунды при использовании оптимизации TensorRT на Nvidia А100.


window-new
Soft
Hard
Тренды 🔥
«Жидкое стекло» Apple можно будет заматировать: представлена нова бета iOS 26.1 12 мин.
Сервисы AWS упали второй раз за день — тысячи сайтов по всему миру снова недоступны 8 ч.
Fujitsu влила £280 млн в британское подразделение в преддверии выплат компенсаций жертвам багов в её ПО Horizon 8 ч.
Календарь релизов 20 – 26 октября: Ninja Gaiden 4, Painkiller, Dispatch и VTM – Bloodlines 2 8 ч.
В Windows сломалась аутентификация по смарт-картам после октябрьских обновлений — у Microsoft есть временное решение 9 ч.
Вместо Majesty 3: российские разработчики выпустили в Steam амбициозную фэнтезийную стратегию Lessaria: Fantasy Kingdom Sim 9 ч.
Слухи: Лана Дель Рей исполнит заглавную песню для «Джеймса Бонда», но не в кино, а в игре от создателей Hitman 10 ч.
Зов сердца: разработчики Dead Cells объяснили, почему вместо Dead Cells 2 выпустили Windblown 11 ч.
Adobe запустила фабрику ИИ-моделей, заточенных под конкретный бизнес 11 ч.
Китай обвинил США в кибератаках на Национальный центр службы времени — это угроза сетям связи, финансовым системам и не только 12 ч.
Президент США подписал соглашение с Австралией на поставку критически важных минералов на сумму $8,5 млрд 18 мин.
Новая статья: Обзор смартфона realme 15 Pro: светит, но не греется 5 ч.
Ещё одна альтернатива платформам NVIDIA — IBM объединила усилия с Groq 5 ч.
Учёные создали кибер-глаз, частично возвращающий зрение слепым людям 6 ч.
Samsung выпустила недорогой 27-дюймовый геймерский монитор Odyssey OLED G50SF c QD-OLED, 1440p и 180 Гц 6 ч.
Акции Apple обновили исторический максимум на новостях об отличных продажах iPhone 17 8 ч.
Представлен флагман iQOO 15 с чипом Snapdragon 8 Elite Gen 5 и батареей на 7000 мА·ч по цене меньше $600 9 ч.
Нечто из космоса врезалось в лобовое стекло самолёта Boeing 737 MAX компании United Airlines 10 ч.
Умные кольца Oura научатся выявлять признаки гипертонии, как последние Apple Watch 11 ч.
Дешёвая корейская термопаста оказалась вредна для процессоров и здоровья пользователей 11 ч.