Сегодня 04 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia внезапно представила ИИ-чип Rubin CPX со 128 Гбайт GDDR7 для обработки длинных контекстов

Компания Nvidia представила специализированный графический процессор Rubin CPX, оснащённый 128 Гбайт памяти. Rubin CPX — это GPU, предназначенный для задач вывода ИИ и работы с моделями, использующими длинный контекст.

 Источник изображения: VideoCardz

Источник изображения: VideoCardz

Rubin CPX использует монолитную конструкцию кристалла и основан на архитектуре Rubin. Nvidia заявляет о его оснащении 128 Гбайт памяти GDDR7 и производительности до 30 Пфлопс в операциях NVFP4. Графический процессор включает по четыре блока NVENC и NVDEC для обработки видео.

 Источник изображения здесь и ниже: Hardaweluxx

Источник изображения здесь и ниже: Hardaweluxx

По заявлениям Nvidia, Rubin CPX обеспечивает трёхкратное повышение производительности вычислений внимания по сравнению с GB300 NVL72 при обработке длинных контекстов.

Nvidia позиционирует серверные стойки Vera Rubin NVL144 (без CPX) как решения для обучения ИИ-моделей и для вывода данных. Они обеспечивают производительность 3,6 Эфлопса в операциях NVFP4, обладают пропускной способностью 1,4 Пбайт/с памяти HBM4 и быстрым хранилищем ёмкостью 75 Тбайт. Поставки стоек NVL144 запланированы на вторую половину 2026 года, а NVL144 CPX — на конец 2026 года. Nvidia сообщила, что приступила к квалификационному тестированию Rubin несколько недель назад.

Rubin CPX будет поставляться как часть платформы Vera Rubin NVL144 CPX вместе с графическими процессорами Rubin и центральными процессорами Vera. В их состав могут входить: 144 графических чипа Rubin CPX, 144 графических чипа Rubin GPU, 36 процессоров Vera (на одну стойку) и 100 Тбайт памяти с пропускной способностью 1,7 Пбайт/с. Вычислительная производительность составит 8 Эфлопс в операциях NVFP4. Сетевые и межсетевые решения будут основаны на NVLink 6 Gen, Spectrum-6 и ConnectX-9.

Архитектура Rubin Ultra, ожидаемая в 2027 году, увеличит плотность размещения графических процессоров до четырёх на модуль и будет использовать память HBM4E. Решения на архитектуре Feynman запланированы на 2028 год, вместе с переходом на NVLink 8, Spectrum-7 и ConnectX-10.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: EMPULSE — восторг или эпитафия? Предварительный обзор 19 мин.
Корейское отделение Netflix проговорилось о дате выхода Cyberpunk: Edgerunners 2 2 ч.
Разработчики Ghostrunner с удовольствием бы занялись Ghostrunner 3, но есть нюанс 4 ч.
Anthropic хочет стать фармкомпанией — лекарства будет разрабатывать ИИ 5 ч.
Слухи: амбициозный российский боевик «Война миров: Сибирь» сравнялся по бюджету с Kingdom Come: Deliverance 2 5 ч.
«Чувствовал, будто расхожусь по швам»: ведущие разработчики Suicide Squad: Kill the Justice League едва не ушли из индустрии из-за провала игры 7 ч.
Alibaba запретила сотрудникам пользоваться помощником программиста Claude Code от Anthropic 8 ч.
Продажи Cyberpunk 2077 превысили 40 млн копий за пять с половиной лет после релиза 8 ч.
Epic Games Store выдал планы Square Enix на сюжетные дополнения к Final Fantasy VII Revelation 8 ч.
Зафиксирована первая в истории полностью автономная атака ИИ- вымогателя 8 ч.