Сегодня 01 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia внезапно представила ИИ-чип Rubin CPX со 128 Гбайт GDDR7 для обработки длинных контекстов

Компания Nvidia представила специализированный графический процессор Rubin CPX, оснащённый 128 Гбайт памяти. Rubin CPX — это GPU, предназначенный для задач вывода ИИ и работы с моделями, использующими длинный контекст.

 Источник изображения: VideoCardz

Источник изображения: VideoCardz

Rubin CPX использует монолитную конструкцию кристалла и основан на архитектуре Rubin. Nvidia заявляет о его оснащении 128 Гбайт памяти GDDR7 и производительности до 30 Пфлопс в операциях NVFP4. Графический процессор включает по четыре блока NVENC и NVDEC для обработки видео.

 Источник изображения здесь и ниже: Hardaweluxx

Источник изображения здесь и ниже: Hardaweluxx

По заявлениям Nvidia, Rubin CPX обеспечивает трёхкратное повышение производительности вычислений внимания по сравнению с GB300 NVL72 при обработке длинных контекстов.

Nvidia позиционирует серверные стойки Vera Rubin NVL144 (без CPX) как решения для обучения ИИ-моделей и для вывода данных. Они обеспечивают производительность 3,6 Эфлопса в операциях NVFP4, обладают пропускной способностью 1,4 Пбайт/с памяти HBM4 и быстрым хранилищем ёмкостью 75 Тбайт. Поставки стоек NVL144 запланированы на вторую половину 2026 года, а NVL144 CPX — на конец 2026 года. Nvidia сообщила, что приступила к квалификационному тестированию Rubin несколько недель назад.

Rubin CPX будет поставляться как часть платформы Vera Rubin NVL144 CPX вместе с графическими процессорами Rubin и центральными процессорами Vera. В их состав могут входить: 144 графических чипа Rubin CPX, 144 графических чипа Rubin GPU, 36 процессоров Vera (на одну стойку) и 100 Тбайт памяти с пропускной способностью 1,7 Пбайт/с. Вычислительная производительность составит 8 Эфлопс в операциях NVFP4. Сетевые и межсетевые решения будут основаны на NVLink 6 Gen, Spectrum-6 и ConnectX-9.

Архитектура Rubin Ultra, ожидаемая в 2027 году, увеличит плотность размещения графических процессоров до четырёх на модуль и будет использовать память HBM4E. Решения на архитектуре Feynman запланированы на 2028 год, вместе с переходом на NVLink 8, Spectrum-7 и ConnectX-10.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про технологии и рынок it

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Амбициозный боевик Kena: Scars of Kosmora превзойдёт Kena: Bridge of Spirits по масштабу и качеству, но не в 2026 году 3 ч.
Google бьёт тревогу: ИИ научил хакеров быстрее превращать известные уязвимости в оружие 3 ч.
Спустя 13 лет работы закрылась студия Nerial, создавшая Reigns: The Witcher и Card Shark 4 ч.
Почти как в старые добрые времена: критики вынесли вердикт Gears of War: E-Day 4 ч.
Великобритания обвинила Китай в использовании учёных для шпионажа в технологической сфере 5 ч.
Krafton отменила разработку эвакуационного шутера PUBG: Black Budget после двух тестов 5 ч.
AMD представила ИИ-ассистента Ross для разработки встраиваемых систем 6 ч.
Ретрофэнтезийный ролевой боевик Queen’s Domain в духе King's Field не заставит себя долго ждать — новый трейлер и дата выхода 9 ч.
Неизвестные ИИ-агенты атаковали сайт правительства Канады 9 ч.
Россияне стали чаще использовать «Яндекс Браузер» из-за проблем с сертификатами отечественных сайтов 9 ч.