Сегодня 09 июня 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia вступит в битву за инференс: готовится чип на технологиях Groq для OpenAI и ИИ-агентов

Nvidia намерена представить новый процессор, специально разработанный для того, чтобы помочь OpenAI и другим клиентам создавать более быстрые и эффективные приложения на основе обученных моделей искусственного интеллекта, сообщает The Wall Street Journal. Ранее продукты компании были ориентированы в первую очередь на обучение ИИ.

 Источник изображений: nvidia.com

Источник изображений: nvidia.com

Nvidia ведёт разработку новой системы для инференса — запуска моделей ИИ, когда они отвечают на запросы пользователей. Новая платформа, которую компания представит на конференции для разработчиков Nvidia GTC в марте, будет включать чип, разработанный стартапом Groq. Конкуренция в этой области сейчас ожесточается — Google и Amazon уже создали собственные ускорители, способные сравниться с продукцией Nvidia; ситуацию усугубляет взрывной рост популярности технологий вайб-кодинга — написания программных продуктов системами ИИ по текстовым запросам пользователей.

Одним из крупнейших клиентов на новый процессор уже согласилась стать OpenAI, сообщают источники издания, и это крупная победа для Nvidia. Накануне разработчик ChatGPT намекнул на этот проект, объявив о заключении крупной сделки по приобретению «выделенных мощностей для инференса» у Nvidia, а также об инвестициях в размере $30 млрд от «зелёного» производителя. Компания также заключила соглашение на предмет использования ИИ-ускорителей Amazon Trainium.

Nvidia доминирует на рынке графических процессоров (GPU) — чипов, способных одновременно выполнять миллиарды простых задач. GPU семейств Hopper, Blackwell и Rubin считаются лучшими для обучения ИИ, и здесь доля компании на мировом рынке, по оценкам аналитиков, составляет не менее 90 %. Глава компании Дженсен Хуанг (Jensen Huang) утверждает, что продукция Nvidia одинаково хорошо подходит и для обучения, и для инференса. Однако разработчики ИИ-агентов и других приложений на основе ИИ начинают понимать, что по сравнению с разработками конкурентов чипы Nvidia слишком дороги, слишком энергозатратны и не так хорошо подходят для запуска уже обученных моделей.

В январе OpenAI заключила со стартапом Cerebras соглашение о партнёрстве — компания предложила ориентированный на инференс чип, который, по её утверждению, работает быстрее ускорителей Nvidia. OpenAI начала переговоры с Cerebras ещё минувшей осенью, когда инженеры компании запросили более быстрое оборудование для приложений агентного написания кода. Nvidia же в минувшем году заключила со стартапом Groq сделку на $20 млрд, лицензировав её технологии и приняв на работу топ-менеджеров компании, включая её основателя. Groq разработала чипы на принципиально иной архитектуре — они включают «блоки языковой обработки», отличающиеся высокой эффективностью в задачах инференса. О своих намерениях использовать эти активы Nvidia пока умалчивает.

Одним из наиболее востребованных направлений в сфере ИИ являются задачи, связанные с генерацией программного кода. Лидером здесь считается сервис Anthropic Claude Code, который работает в облачных инфраструктурах Amazon и Google, но активно развивается и служба OpenAI Codex, которая будет работать на новой инфраструктуре Nvidia. Nvidia также заключила соглашение с компанией Meta об инференсе ИИ-систем для таргетирования рекламы — и эта задача эффективнее всего решается на центральных процессорах.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Продажи Street Fighter 6 превысили 7 млн копий, а в файтинге скоро появится Тифа Локхарт из Final Fantasy VII 2 мин.
Instagram разрешил всем пользователям менять местами публикации в профиле 45 мин.
Apple доверит Google конфиденциальные данные пользователей из Apple Intelligence 47 мин.
Apple Intelligence сможет самостоятельно исправлять скомпрометированные пароли 2 ч.
В России количество атак киберпреступников-вымогателей снизилось, но это лишь передышка 2 ч.
Стартап Perplexity заявил, что не торопится с IPO и проведёт его не ранее 2028 года 2 ч.
Хоронить пока рано: амбициозный экшен Marvel’s Blade от авторов Deathloop и Dishonored «не мёртв» 3 ч.
Apple представила расширенные средства родительского контроля на iPhone 3 ч.
«Приключение только начинается!»: олдскульный боевик Mina the Hollower от создателей Shovel Knight достиг новой вершины продаж 3 ч.
Apple анонсировала macOS 27 Golden Gate с Siri AI и средствами настройки Liquid Glass 3 ч.
Сначала энергия: Google внедряет в Техасе бизнес-модель Power-First в ответ на дефицит электричества для ЦОД 37 мин.
Подорожание смартфонов и ноутбуков в России могут отложить: запуск технологического сбора перенесут на декабрь 40 мин.
Тим Кук произнёс прощальную речь на своей последней презентации в роли главы Apple 44 мин.
Apple Watch Series 9 всё же получат обновление до watchOS 27 — Apple признала ошибку 48 мин.
Как в «Безумном Максе»: Meta строит в США «палаточные» ЦОД для ИИ-серверов на миллиарды долларов 52 мин.
Власти США хотят перекрыть китайским компаниям одну из лазеек для получения передовых чипов 2 ч.
В России стартовали продажи смартфона Realme C100i — ударопрочный корпус и батарея на 7000 мА·ч за 13 999 рублей 2 ч.
InnoGrit представила контроллер для SSD с интерфейсом PCIe 6.0 вместимостью до 256 Тбайт 2 ч.
В России стартовали продажи белорусских планшетов Horizont H-Tab 3 ч.
OpenAI подала заявку на IPO, но пока не раскрывает его сроки и параметры 4 ч.