Сегодня 09 июня 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia вступит в битву за инференс: готовится чип на технологиях Groq для OpenAI и ИИ-агентов

Nvidia намерена представить новый процессор, специально разработанный для того, чтобы помочь OpenAI и другим клиентам создавать более быстрые и эффективные приложения на основе обученных моделей искусственного интеллекта, сообщает The Wall Street Journal. Ранее продукты компании были ориентированы в первую очередь на обучение ИИ.

 Источник изображений: nvidia.com

Источник изображений: nvidia.com

Nvidia ведёт разработку новой системы для инференса — запуска моделей ИИ, когда они отвечают на запросы пользователей. Новая платформа, которую компания представит на конференции для разработчиков Nvidia GTC в марте, будет включать чип, разработанный стартапом Groq. Конкуренция в этой области сейчас ожесточается — Google и Amazon уже создали собственные ускорители, способные сравниться с продукцией Nvidia; ситуацию усугубляет взрывной рост популярности технологий вайб-кодинга — написания программных продуктов системами ИИ по текстовым запросам пользователей.

Одним из крупнейших клиентов на новый процессор уже согласилась стать OpenAI, сообщают источники издания, и это крупная победа для Nvidia. Накануне разработчик ChatGPT намекнул на этот проект, объявив о заключении крупной сделки по приобретению «выделенных мощностей для инференса» у Nvidia, а также об инвестициях в размере $30 млрд от «зелёного» производителя. Компания также заключила соглашение на предмет использования ИИ-ускорителей Amazon Trainium.

Nvidia доминирует на рынке графических процессоров (GPU) — чипов, способных одновременно выполнять миллиарды простых задач. GPU семейств Hopper, Blackwell и Rubin считаются лучшими для обучения ИИ, и здесь доля компании на мировом рынке, по оценкам аналитиков, составляет не менее 90 %. Глава компании Дженсен Хуанг (Jensen Huang) утверждает, что продукция Nvidia одинаково хорошо подходит и для обучения, и для инференса. Однако разработчики ИИ-агентов и других приложений на основе ИИ начинают понимать, что по сравнению с разработками конкурентов чипы Nvidia слишком дороги, слишком энергозатратны и не так хорошо подходят для запуска уже обученных моделей.

В январе OpenAI заключила со стартапом Cerebras соглашение о партнёрстве — компания предложила ориентированный на инференс чип, который, по её утверждению, работает быстрее ускорителей Nvidia. OpenAI начала переговоры с Cerebras ещё минувшей осенью, когда инженеры компании запросили более быстрое оборудование для приложений агентного написания кода. Nvidia же в минувшем году заключила со стартапом Groq сделку на $20 млрд, лицензировав её технологии и приняв на работу топ-менеджеров компании, включая её основателя. Groq разработала чипы на принципиально иной архитектуре — они включают «блоки языковой обработки», отличающиеся высокой эффективностью в задачах инференса. О своих намерениях использовать эти активы Nvidia пока умалчивает.

Одним из наиболее востребованных направлений в сфере ИИ являются задачи, связанные с генерацией программного кода. Лидером здесь считается сервис Anthropic Claude Code, который работает в облачных инфраструктурах Amazon и Google, но активно развивается и служба OpenAI Codex, которая будет работать на новой инфраструктуре Nvidia. Nvidia также заключила соглашение с компанией Meta об инференсе ИИ-систем для таргетирования рекламы — и эта задача эффективнее всего решается на центральных процессорах.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Октябрьский скачок цен на Game Pass обернулся для Xbox потерей «миллионов подписчиков» 17 мин.
Google экстренно обновила Chrome, закрыв уязвимость нулевого дня, которую эксплуатировали хакеры 27 мин.
Продажи Street Fighter 6 превысили 7 млн копий, а в файтинге скоро появится Тифа Локхарт из Final Fantasy VII 38 мин.
Instagram разрешил всем пользователям менять местами публикации в профиле 2 ч.
Apple доверит Google конфиденциальные данные пользователей из Apple Intelligence 2 ч.
Apple Intelligence сможет самостоятельно исправлять скомпрометированные пароли 2 ч.
В России количество атак киберпреступников-вымогателей снизилось, но это лишь передышка 3 ч.
Стартап Perplexity заявил, что не торопится с IPO и проведёт его не ранее 2028 года 3 ч.
В России может появиться «ГосVPN» для разработчиков ПО 3 ч.
Хоронить пока рано: амбициозный экшен Marvel’s Blade от авторов Deathloop и Dishonored «не мёртв» 3 ч.
Учёные превратили одноразовые стаканчики в поглотители CO2 из воздуха 23 мин.
Илон Маск: у SpaceX уже есть почти все технологии, необходимые для строительства ЦОД в космосе 26 мин.
Акции азиатских ИТ-компаний вернулись к росту после вчерашнего спада 27 мин.
Сначала энергия: Google внедряет в Техасе бизнес-модель Power-First в ответ на дефицит электричества для ЦОД 2 ч.
Подорожание смартфонов и ноутбуков в России могут отложить: запуск технологического сбора перенесут на декабрь 2 ч.
Apple Watch Series 9 всё же получат обновление до watchOS 27 — Apple признала ошибку 2 ч.
Как в «Безумном Максе»: Meta строит в США «палаточные» ЦОД для ИИ-серверов на миллиарды долларов 2 ч.
Власти США хотят перекрыть китайским компаниям одну из лазеек для получения передовых чипов 2 ч.
InnoGrit представила контроллер для SSD с интерфейсом PCIe 6.0 вместимостью до 256 Тбайт 3 ч.
В России стартовали продажи белорусских планшетов Horizont H-Tab 4 ч.