Сегодня 11 марта 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia внезапно представила ИИ-чип Rubin CPX со 128 Гбайт GDDR7 для обработки длинных контекстов

Компания Nvidia представила специализированный графический процессор Rubin CPX, оснащённый 128 Гбайт памяти. Rubin CPX — это GPU, предназначенный для задач вывода ИИ и работы с моделями, использующими длинный контекст.

 Источник изображения: VideoCardz

Источник изображения: VideoCardz

Rubin CPX использует монолитную конструкцию кристалла и основан на архитектуре Rubin. Nvidia заявляет о его оснащении 128 Гбайт памяти GDDR7 и производительности до 30 Пфлопс в операциях NVFP4. Графический процессор включает по четыре блока NVENC и NVDEC для обработки видео.

 Источник изображения здесь и ниже: Hardaweluxx

Источник изображения здесь и ниже: Hardaweluxx

По заявлениям Nvidia, Rubin CPX обеспечивает трёхкратное повышение производительности вычислений внимания по сравнению с GB300 NVL72 при обработке длинных контекстов.

Nvidia позиционирует серверные стойки Vera Rubin NVL144 (без CPX) как решения для обучения ИИ-моделей и для вывода данных. Они обеспечивают производительность 3,6 Эфлопса в операциях NVFP4, обладают пропускной способностью 1,4 Пбайт/с памяти HBM4 и быстрым хранилищем ёмкостью 75 Тбайт. Поставки стоек NVL144 запланированы на вторую половину 2026 года, а NVL144 CPX — на конец 2026 года. Nvidia сообщила, что приступила к квалификационному тестированию Rubin несколько недель назад.

Rubin CPX будет поставляться как часть платформы Vera Rubin NVL144 CPX вместе с графическими процессорами Rubin и центральными процессорами Vera. В их состав могут входить: 144 графических чипа Rubin CPX, 144 графических чипа Rubin GPU, 36 процессоров Vera (на одну стойку) и 100 Тбайт памяти с пропускной способностью 1,7 Пбайт/с. Вычислительная производительность составит 8 Эфлопс в операциях NVFP4. Сетевые и межсетевые решения будут основаны на NVLink 6 Gen, Spectrum-6 и ConnectX-9.

Архитектура Rubin Ultra, ожидаемая в 2027 году, увеличит плотность размещения графических процессоров до четырёх на модуль и будет использовать память HBM4E. Решения на архитектуре Feynman запланированы на 2028 год, вместе с переходом на NVLink 8, Spectrum-7 и ConnectX-10.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google обеспечит Пентагон ИИ-агентами на базе Gemini 12 мин.
Все открытые в «Яндекс Браузере» страницы теперь можно обсуждать с «Алисой AI» 20 мин.
Джей и молчаливый Боб наносят ответный удар: олдскульный боевик Jay and Silent Bob: Chronic Blunt Punch спустя 10 лет после анонса получил дату выхода 60 мин.
Meta купила нашумевшую соцсеть для ИИ-агентов Moltbook 2 ч.
Google расширила возможности Gemini в «Документах», «Таблицах», «Презентациях» и «Диске» 3 ч.
«Вдвое меньше, но вдвое лучше»: ZA/UM не считает Zero Parades: For Dead Spies сиквелом или духовным наследником Disco Elysium 3 ч.
Британские музыканты обвинили Valve в нарушении авторских прав 3 ч.
ИИ-приложения лучше обычных зарабатывают на старте, но быстрее теряют пользователей 6 ч.
Российский суд оштрафовал Google на 11,4 млн руб. за неудаление запрещённого контента 15 ч.
Assassin’s Creed Black Flag Resynced скоро выйдет из тени — инсайдер подтвердил, когда Ubisoft анонсирует и выпустит неуловимый ремейк 17 ч.
Китай намерен впервые высадить тайконавтов на Луну в местном «геологическом музее» — районе Римае-Боде 13 мин.
Эскалация конфликта на Ближнем Востоке угрожает буму ИИ ЦОД в регионе 30 мин.
ИИ напакостил: Amazon созвала экстренное совещание из-за сбоев, вызванных изменениями в коде «с участием генеративного ИИ» 37 мин.
В Китае сети 6G планируют поставить на коммерческие рельсы уже к 2030 году 60 мин.
На межзвёздной комете 3I/Atlas не оказалось инопланетян, но зато нашлось очень много спирта 2 ч.
NASA и SpaceX поспорили о ручном управлении при посадке на Луну 2 ч.
Новая статья: ИИтоги февраля 2026 г.: мы в ответе за то, что обучили 2 ч.
Память заняла до 43 % себестоимости бюджетных смартфонов — роста цен не избежать 3 ч.
Спрос на сетевые ИИ-решения обеспечил HPE один из самых прибыльных кварталов 3 ч.
Alibaba Cloud ускорит строительство дата-центра на основе собственных ИИ-чипов Zhenwu в Шанхае 3 ч.