Сегодня 30 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia вступит в битву за инференс: готовится чип на технологиях Groq для OpenAI и ИИ-агентов

Nvidia намерена представить новый процессор, специально разработанный для того, чтобы помочь OpenAI и другим клиентам создавать более быстрые и эффективные приложения на основе обученных моделей искусственного интеллекта, сообщает The Wall Street Journal. Ранее продукты компании были ориентированы в первую очередь на обучение ИИ.

 Источник изображений: nvidia.com

Источник изображений: nvidia.com

Nvidia ведёт разработку новой системы для инференса — запуска моделей ИИ, когда они отвечают на запросы пользователей. Новая платформа, которую компания представит на конференции для разработчиков Nvidia GTC в марте, будет включать чип, разработанный стартапом Groq. Конкуренция в этой области сейчас ожесточается — Google и Amazon уже создали собственные ускорители, способные сравниться с продукцией Nvidia; ситуацию усугубляет взрывной рост популярности технологий вайб-кодинга — написания программных продуктов системами ИИ по текстовым запросам пользователей.

Одним из крупнейших клиентов на новый процессор уже согласилась стать OpenAI, сообщают источники издания, и это крупная победа для Nvidia. Накануне разработчик ChatGPT намекнул на этот проект, объявив о заключении крупной сделки по приобретению «выделенных мощностей для инференса» у Nvidia, а также об инвестициях в размере $30 млрд от «зелёного» производителя. Компания также заключила соглашение на предмет использования ИИ-ускорителей Amazon Trainium.

Nvidia доминирует на рынке графических процессоров (GPU) — чипов, способных одновременно выполнять миллиарды простых задач. GPU семейств Hopper, Blackwell и Rubin считаются лучшими для обучения ИИ, и здесь доля компании на мировом рынке, по оценкам аналитиков, составляет не менее 90 %. Глава компании Дженсен Хуанг (Jensen Huang) утверждает, что продукция Nvidia одинаково хорошо подходит и для обучения, и для инференса. Однако разработчики ИИ-агентов и других приложений на основе ИИ начинают понимать, что по сравнению с разработками конкурентов чипы Nvidia слишком дороги, слишком энергозатратны и не так хорошо подходят для запуска уже обученных моделей.

В январе OpenAI заключила со стартапом Cerebras соглашение о партнёрстве — компания предложила ориентированный на инференс чип, который, по её утверждению, работает быстрее ускорителей Nvidia. OpenAI начала переговоры с Cerebras ещё минувшей осенью, когда инженеры компании запросили более быстрое оборудование для приложений агентного написания кода. Nvidia же в минувшем году заключила со стартапом Groq сделку на $20 млрд, лицензировав её технологии и приняв на работу топ-менеджеров компании, включая её основателя. Groq разработала чипы на принципиально иной архитектуре — они включают «блоки языковой обработки», отличающиеся высокой эффективностью в задачах инференса. О своих намерениях использовать эти активы Nvidia пока умалчивает.

Одним из наиболее востребованных направлений в сфере ИИ являются задачи, связанные с генерацией программного кода. Лидером здесь считается сервис Anthropic Claude Code, который работает в облачных инфраструктурах Amazon и Google, но активно развивается и служба OpenAI Codex, которая будет работать на новой инфраструктуре Nvidia. Nvidia также заключила соглашение с компанией Meta об инференсе ИИ-систем для таргетирования рекламы — и эта задача эффективнее всего решается на центральных процессорах.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Атмосферный трейлер раскрыл дату погружения Subnautica 2 в ранний доступ — ждать осталось недолго 29 мин.
Google готова показывать рекламу в Gemini — OpenAI уже делает это в ChatGPT 34 мин.
«Продолжаете удивлять, капитаны!»: пиратский хит Windrose достиг новой вершины продаж и получил патч с техническими улучшениями 2 ч.
Обновлённые Microsoft PowerToys научились управлять мониторами и улучшили работу с окнами 2 ч.
OpenAI объяснила борьбу с гремлинами в ответах ИИ — и позволила снять ограничения 3 ч.
Работник Warner Bros. Games проговорился, что следующей игрой создателей Mortal Kombat станет Injustice 3 3 ч.
«DLSS 5 у нас дома»: Roblox готовит Reality — фотореалистичную игровую платформу с ИИ-рендерингом 3 ч.
Heroes of Might & Magic: Olden Era вышла в раннем доступе Steam — фанаты ждали этого 11 лет 4 ч.
Провайдер Cloudflare назвал мессенджер Max шпионским и вредоносным — разработчики ответили 5 ч.
VK Tech предложила бизнесу платформу VK AI Space для создания и запуска ИИ-агентов 5 ч.
Noctua объяснила, почему чёрные вентиляторы выходят позже стандартных бежево-коричневых 35 мин.
Бум ИИ сделал микросхемы памяти одним из самых прибыльных продуктов в мире 47 мин.
Запуск телескопа NASA «Роман» не свернёт работу «Хаббла» — её продолжат, а то и расширят 48 мин.
Samsung предупредила, что дефицит оперативной памяти может ещё больше усугубиться в 2027 году 51 мин.
Представлены ретрофутуристические портативные консоли, вдохновлённые легендарными Commodore 64 и ZX Spectrum 2 ч.
Reliance потратит $17 млрд на крупнейший в Индии кластер ЦОД мощностью 1,5 ГВт 3 ч.
Бум ИИ оставил стройки жилых домов без электриков — в дата-центрах платят больше 3 ч.
Учёные близки к разгадке тайны «маленьких красных точек» в глубинах Вселенной — «Уэбб» засёк у одной из них признаки чёрной дыры 3 ч.
Samsung готовит ноутбуки на Aluminium OS — компьютерный Android получит интерфейс One UI 3 ч.
SoftBank готовится отправить роботов строить дата-центры 3 ч.