Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → стойка

За шесть лет производительность стоечных решений AMD возрастёт в двадцать раз

В дополнение к обычным планам развития продуктов и технологий, AMD в 2025 году представила инициативу «20x2030», которая обещала увеличить энергоэффективность стоечных решений для ИИ в 20 раз к 2030 году. AMD исходила из предположения, что её стоечные системы 2026 года будут в три раза производительнее, чем поколение 2024 года. На практике, они оказались эффективнее в четыре раза, что позволяет рассчитывать на перевыполнение планов AMD к 2030 году.

 Источник изображения: AMD

Источник изображения: AMD

Стоит оговориться, что AMD оценивает свой прогресс на уровне стоек, а не на уровне процессоров и ускорителей ИИ, что, очевидно, даёт компании большую свободу в оптимизации производительности. Компания учитывает улучшения в вычислительной производительности, технологическом процессе, пропускной способности памяти, перемещении данных, интерконнектах, программном обеспечении и совместном проектировании на системном уровне.

По словам AMD, три основные характеристики оборудования определяют производительность системы ИИ: вычислительные возможности, пропускная способность памяти и пропускная способность интерконнекта. Новые технологические процессы и архитектуры повышают производительность вычислений с плавающей запятой на ватт, а улучшения в интеграции памяти и высокоскоростные интерконнекты увеличивают пропускную способность, доступную чипам. AMD ожидает, что эти разработки в совокупности обеспечат в 20 раз более высокую производительность ИИ на ватт к 2030 году по сравнению с базовым показателем 2024 года.

Память и интерконнекты играют особенно важную роль, поскольку современные системы ИИ, как правило, перемещают огромные объёмы данных. AMD заявляет, что более высокая пропускная способность памяти, большая плотность полосы пропускания, улучшенная пропускная способность на ватт, большие кеши и более тесная интеграция памяти и вычислительных ресурсов могут снизить потери энергии и повысить эффективность работы.

Более быстрые масштабируемые интерконнекты могут улучшить связь между ускорителями, центральными процессорами и другими компонентами, что также повышает эффективность работы. Оптимизация ПО AMD — ещё одна часть усилий, поскольку более высокая производительность, достигаемая благодаря оптимизации, в конечном итоге означает меньшее энергопотребление, необходимое для достижения ожидаемого результата.

Четырёхкратное улучшение энергоэффективности (и, соответственно, производительности) следует рассматривать как оценку AMD, а не как прямое сравнение двух коммерчески доступных стоечных систем. AMD измеряет прогресс, сравнивая ежегодные репрезентативные стоечные конфигурации с базовым уровнем 2024 года, используя методологию расчёта производительности на ватт.

Кроме того, в расчёте на 2026 год используются данные измерений реальных продуктов и результаты моделирования в тех случаях, когда окончательные показатели производительности были недоступны, что, по сути, означает, что AMD не использует свои новейшие ускорители Instinct MI455X для этих оценок.

В случае успеха инициативы «20x2030» две будущие стойки AMD 2030 года смогут обеспечить тот же объем вычислительных ресурсов, что и 570 стоек 2024 года на базе процессора Instinct MI300X. Это, по сути, означает в 20 раз меньшее энергопотребление или в 20 раз более высокую производительность при том же энергопотреблении к 2030 году.

Память в серверах Nvidia подорожала на 435 % при переходе от Blackwell к Vera Rubin — стойку оценили в $7,8 млн

Одна серверная стойка Nvidia VR200 NVL72 нового поколения на архитектуре Vera Rubin обойдётся облачному оператору примерно в $7,8 млн, подчитали в Morgan Stanley. Для сравнения, GB300 NVL72 стоит около $4 млн. Стойка нового поколения VR200 NVL72 содержит больше DRAM и NAND — на память приходятся около 25 % общей стоимости.

 Источник изображения: Nvidia

Источник изображения: Nvidia

В корпусах VR200 NVL72 компания Nvidia намеревается продавать процессоры Vera по $5000 и ускорители искусственного интеллекта Rubin по $55 000 за штуку. В стойках используются уже знакомые клиентам корпуса Oberon, но внутри установлены более сложные компоненты коммутации, сетевых подключений, печатные платы, системы охлаждения, изменились даже технологии упаковки чипов — всё это влияет на стоимость систем и складывается в ценник $7,8 млн за стойку. Только компоненты памяти в стойке VR200 NVL72 обходятся около $2 млн или на 435 % больше, чем в GB300 NVL72.

 Источник изображения: x.com/Aaronwei3n

Источник изображения: x.com/Aaronwei3n

На каждую стойку нового поколения приходятся 54 Тбайт памяти LPDDR5X — втрое больше, чем 17 Тбайт у GB200 NVL72. Nvidia, по оценкам SemiAnalysis, в I квартале платила по $8 за 1 Гбайт LPDDR5X, и дальше этот показатель может только вырасти, особенно если речь идёт о дорогих в производстве и тестировании модулях SOCAMM2. Таким образом, память для GB200 NVL72 обходится в $136 000 на каждую машину; в случае VR200 NVL72 это уже $408 000, а при росте цены до $10 за 1 Гбайт это будут уже $540 000 — даже без учёта наценки самой Nvidia.

Кроме того, в каждой стойке VR200 NVL72 содержится память 3D NAND на сумму не менее $1 млн, тогда как в GB200 NVL72 её практически не было. В результате $2 млн за память на стойку Vera Rubin NVL72 представляется вполне предсказуемым показателем: здесь есть большие объёмы LPDDR5X и 3D NAND, не говоря уже о высокоскоростной HBM4 на самих ускорителях Rubin — и это в условиях дефицита и колоссальных цен на чипы памяти.


window-new
Soft
Hard
Тренды 🔥
ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию 16 ч.
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрд 18 ч.
Valve случайно «слила» 12 Тбайт данных по играм Steam с 2003 по 2013 год, включая ранние сборки Portal 2, Left 4 Dead, CS:GO и не только 18 ч.
Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений 21 ч.
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 30-08 00:08
Следующая жертва ИИ — актёры: в Китае их массово заменяют цифровыми двойниками 29-08 18:18
Бигтехи теряют доверие людей — ИИ, соцсети и наступление ЦОД всё чаще вызывают страх и недовольство 29-08 16:55
Brave научился создавать подставные адреса email — с ними можно не засвечивать настоящий при регистрации на сайтах 29-08 15:37
Война Маска и Альтмана добралась до Cursor — купленный SpaceX сервис лишится моделей OpenAI 29-08 12:12
Китайский открытый ИИ начал закрываться — Z.ai ограничила использование мощнейшей GLM-5.3 29-08 11:26
Флагманские смартфоны POCO F9 Ultra и F9 Pro рассекречены почти полностью в преддверии анонса 2 мин.
SK hynix присматривает площадку в Японии для организации совместного производства памяти 4 ч.
Новая статья: Обзор смартфона Samsung Galaxy Z Flip8: исчезающий вид? 9 ч.
Apple Watch Series 12 и Ultra 4 будут производительнее предшественников, но особых изменений ждать не стоит 13 ч.
Сингапур нашёл 200 МВт новых мощностей для ЦОД, но это только начало более крупного ИИ-проекта 15 ч.
SpaceX провела полномасштабный огневой тест двигателей ускорителя Super Heavy — 14-й полёт не за горами 29-08 20:25
Робоутка за $399 покорила сердца разработчиков — за сутки её заказали на $2,6 млн 29-08 20:23
После анонса GTA VI из американской розницы исчезли Sony PlayStation 5 Pro, а спекулянты взвинтили цены 29-08 17:43
Наноантенны многократно усилили яркость свечения живых клеток — это поможет увидеть активность мозга и не только 29-08 17:41
Японцы испытали «силовое поле» для торможения возвращаемых кораблей в атмосфере 29-08 16:29