Сегодня 20 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → стойка

За шесть лет производительность стоечных решений AMD возрастёт в двадцать раз

В дополнение к обычным планам развития продуктов и технологий, AMD в 2025 году представила инициативу «20x2030», которая обещала увеличить энергоэффективность стоечных решений для ИИ в 20 раз к 2030 году. AMD исходила из предположения, что её стоечные системы 2026 года будут в три раза производительнее, чем поколение 2024 года. На практике, они оказались эффективнее в четыре раза, что позволяет рассчитывать на перевыполнение планов AMD к 2030 году.

 Источник изображения: AMD

Источник изображения: AMD

Стоит оговориться, что AMD оценивает свой прогресс на уровне стоек, а не на уровне процессоров и ускорителей ИИ, что, очевидно, даёт компании большую свободу в оптимизации производительности. Компания учитывает улучшения в вычислительной производительности, технологическом процессе, пропускной способности памяти, перемещении данных, интерконнектах, программном обеспечении и совместном проектировании на системном уровне.

По словам AMD, три основные характеристики оборудования определяют производительность системы ИИ: вычислительные возможности, пропускная способность памяти и пропускная способность интерконнекта. Новые технологические процессы и архитектуры повышают производительность вычислений с плавающей запятой на ватт, а улучшения в интеграции памяти и высокоскоростные интерконнекты увеличивают пропускную способность, доступную чипам. AMD ожидает, что эти разработки в совокупности обеспечат в 20 раз более высокую производительность ИИ на ватт к 2030 году по сравнению с базовым показателем 2024 года.

Память и интерконнекты играют особенно важную роль, поскольку современные системы ИИ, как правило, перемещают огромные объёмы данных. AMD заявляет, что более высокая пропускная способность памяти, большая плотность полосы пропускания, улучшенная пропускная способность на ватт, большие кеши и более тесная интеграция памяти и вычислительных ресурсов могут снизить потери энергии и повысить эффективность работы.

Более быстрые масштабируемые интерконнекты могут улучшить связь между ускорителями, центральными процессорами и другими компонентами, что также повышает эффективность работы. Оптимизация ПО AMD — ещё одна часть усилий, поскольку более высокая производительность, достигаемая благодаря оптимизации, в конечном итоге означает меньшее энергопотребление, необходимое для достижения ожидаемого результата.

Четырёхкратное улучшение энергоэффективности (и, соответственно, производительности) следует рассматривать как оценку AMD, а не как прямое сравнение двух коммерчески доступных стоечных систем. AMD измеряет прогресс, сравнивая ежегодные репрезентативные стоечные конфигурации с базовым уровнем 2024 года, используя методологию расчёта производительности на ватт.

Кроме того, в расчёте на 2026 год используются данные измерений реальных продуктов и результаты моделирования в тех случаях, когда окончательные показатели производительности были недоступны, что, по сути, означает, что AMD не использует свои новейшие ускорители Instinct MI455X для этих оценок.

В случае успеха инициативы «20x2030» две будущие стойки AMD 2030 года смогут обеспечить тот же объем вычислительных ресурсов, что и 570 стоек 2024 года на базе процессора Instinct MI300X. Это, по сути, означает в 20 раз меньшее энергопотребление или в 20 раз более высокую производительность при том же энергопотреблении к 2030 году.

Память в серверах Nvidia подорожала на 435 % при переходе от Blackwell к Vera Rubin — стойку оценили в $7,8 млн

Одна серверная стойка Nvidia VR200 NVL72 нового поколения на архитектуре Vera Rubin обойдётся облачному оператору примерно в $7,8 млн, подчитали в Morgan Stanley. Для сравнения, GB300 NVL72 стоит около $4 млн. Стойка нового поколения VR200 NVL72 содержит больше DRAM и NAND — на память приходятся около 25 % общей стоимости.

 Источник изображения: Nvidia

Источник изображения: Nvidia

В корпусах VR200 NVL72 компания Nvidia намеревается продавать процессоры Vera по $5000 и ускорители искусственного интеллекта Rubin по $55 000 за штуку. В стойках используются уже знакомые клиентам корпуса Oberon, но внутри установлены более сложные компоненты коммутации, сетевых подключений, печатные платы, системы охлаждения, изменились даже технологии упаковки чипов — всё это влияет на стоимость систем и складывается в ценник $7,8 млн за стойку. Только компоненты памяти в стойке VR200 NVL72 обходятся около $2 млн или на 435 % больше, чем в GB300 NVL72.

 Источник изображения: x.com/Aaronwei3n

Источник изображения: x.com/Aaronwei3n

На каждую стойку нового поколения приходятся 54 Тбайт памяти LPDDR5X — втрое больше, чем 17 Тбайт у GB200 NVL72. Nvidia, по оценкам SemiAnalysis, в I квартале платила по $8 за 1 Гбайт LPDDR5X, и дальше этот показатель может только вырасти, особенно если речь идёт о дорогих в производстве и тестировании модулях SOCAMM2. Таким образом, память для GB200 NVL72 обходится в $136 000 на каждую машину; в случае VR200 NVL72 это уже $408 000, а при росте цены до $10 за 1 Гбайт это будут уже $540 000 — даже без учёта наценки самой Nvidia.

Кроме того, в каждой стойке VR200 NVL72 содержится память 3D NAND на сумму не менее $1 млн, тогда как в GB200 NVL72 её практически не было. В результате $2 млн за память на стойку Vera Rubin NVL72 представляется вполне предсказуемым показателем: здесь есть большие объёмы LPDDR5X и 3D NAND, не говоря уже о высокоскоростной HBM4 на самих ускорителях Rubin — и это в условиях дефицита и колоссальных цен на чипы памяти.


window-new
Soft
Hard
Тренды 🔥
Популярные чат-боты в большинстве случаев дают вредные советы в сфере финансов 5 ч.
Новая статья: The Blood of Dawnwalker — начало чего-то выдающегося. Рецензия 12 ч.
Путь на дно: суд обязал Microsoft раскрыть внутренние документы и переписку топ-менеджеров в деле о перепродаже лицензий на ПО 18 ч.
Персональный ИИ-агент Muse от Meta возглавил рейтинг App Store всего через неделю после релиза 22 ч.
SpaceXAI удвоила точность распознавания речи в новой модели Grok Voice Transcribe 2.0 23 ч.
Anthropic сделала первый шаг к замедлению ИИ — Accenture будет проверять Claude изнутри 23 ч.
Европейские разработчики ИИ выступили против призывов США замедлить темп 19-09 10:43
Alibaba выпустила всеядную модель Qwen3.8-Omni-Flash с контекстом на 1 млн токенов 19-09 10:08
Anthropic до IPO собирается выпустить ИИ-модель, которая станет ответом на OpenAI GPT-6 Astra 19-09 07:25
Новая статья: Doloc Town — достойная наследница Stardew Valley. Рецензия 19-09 00:10
GPT-6 Astra и Claude Fable превратили роботов в комичных убийц — ИИ провалил новый тест безопасности 4 ч.
На следующей неделе Meta покажет AR-гарнитуру Phoenix и фотореалистичные голографические аватары для видеозвонков 6 ч.
Anthropic и OpenAI переключились на аренду небольших ИИ ЦОД 9 ч.
Урезанная Radeon RX 9050 с 4 Гбайт памяти оказалась в среднем на 37 % медленнее версии с 8 Гбайт 18 ч.
Исследователь OpenAI предупредил: ИИ-агенты способны общаться даже на отключённых от Сети компьютерах 19 ч.
Создана не имеющая аналогов плёночная теплоизоляция — она сдерживает тепло в пять раз лучше силикона 19 ч.
До 64 Пбайт для KV-кеша: Huawei представила платформу хранения OceanStor M900 для ИИ ЦОД 20 ч.
Китай взял под контроль рынок ЖК-панелей — теперь Samsung и LG придётся платить больше 22 ч.
«Искусственные листья» научили добывать водород из грязной морской воды — для этого нужен только солнечный свет 23 ч.
HP представила ноутбук со 192 Гбайт памяти — 160 Гбайт можно отдать встроенной Radeon 23 ч.