Meta✴ заставит ИИ работать дешевле — фирменные ускорители потеснят Nvidia в ЦОД уже в 2027 году
Читать в полной версииMeta✴ Platforms планирует начать использование новых ИИ-ускорителей собственной разработки в центрах обработки данных в первой половине следующего года. В компании заявили, что это позволить сэкономить денежные средства и энергию при работе с ИИ-моделями.
Источник изображений: Meta✴
Впервые о планах по созданию собственных ИИ-ускорителей Meta✴ объявила ещё в 2023 году. В настоящее время проходит тестирование третьего поколения ускорителей линейки — MTIA 450 (Meta✴ Training and Inference Accelerator, он же Arke). Проектирование следующего ускорителя MTIA 500, который разрабатывается под кодовым именем Astrid, завершится примерно через месяц, а его эксплуатация в центрах обработки данных начнётся в конце следующего года.
«С каждым новым ускорителем мы берём на себя чуть больший технологический риск и получаем более высокую производительность», — прокомментировал данный вопрос вице-президент Meta✴ по инженерным вопросам Йи Джун Сон (Yee Jiun Song). По его словам, речь идёт о повышении производительности на каждый затраченный ватт энергии и на каждый потраченный доллар.
Meta✴, являющаяся владельцем Facebook✴, Instagram✴ и WhatsApp, разрабатывает собственные ускорители в рамках реализации масштабной программы по созданию обширной ИИ-инфраструктуры. В части проектирования гигант соцсетей сотрудничает с Broadcom, а в области производства — с TSMC. Этот проект призван снизить зависимость Meta✴ от продукции Nvidia, которая является лидером в сфере разработки ИИ-ускорителей.
Если оценивать по энергопотреблению, ключевому показателю для индустрии ИИ-ЦОД, Meta✴ планирует в течение года задействовать ускорителей, суммарной мощностью более гигаватта. После этого, по словам Сона, который курирует программу Meta✴ по разработке собственных чипов, «ожидается ускорение темпов». Он добавил, что такой прогноз будет актуальным при условии, что не произойдёт обвала рынка ИИ или падения спроса.
MTIA 450 / Источник изображения: Meta✴
ИИ-подразделение Meta✴ Superintelligence Labs помогает дорабатывать будущие ИИ-ускорители. Разработчики предоставляют информацию о будущих ИИ-моделях и требованиях к оборудованию для их запуска. Сон отметил, что такой подход помогает делать ускорители при запуске ИИ-моделей более эффективными, чем «то, что сейчас поставляет Nvidia». По его словам, это происходит «просто потому, что мы сами выполняем большую часть инженерной работы».
По данным источника, TSMC передала Meta✴ 12 новых ускорителей 1 сентября. Их производительность соответствует прогнозам и отклоняется всего на 2-3 % от результатов симуляций. В тот же день инженеры задействовали ускорители для работы с ИИ-моделями Meta✴, а также алгоритмами от DeepSeek и Alibaba.
Первичные тесты показали, что в конструкции новых ускорителей нет проблем. Однако впереди ещё много работы, связанной с испытанием и настройкой новых устройств. Это займёт несколько месяцев, а параллельно будет наращиваться объём производства ИИ-ускорителей. Все четыре поколения ускорителей Meta✴ в основном используют память с высокой пропускной способностью и не рассчитаны на сегмент, где от ИИ-моделей ожидается предельно быстрая реакция. «Это рабочие лошадки, которые мы планируем использовать для инференса общего назначения», — рассказал Сон.
Ранее компания планировала использовать ИИ-ускорители, которые разрабатывались под кодовым именем Olympus и которые должны были подходить для обучения ИИ-моделей, а также для инференса. Ускоритель должен был появиться в 2028-2029 годах, но Meta✴ отказалась от этого проекта, в том числе по финансовым соображениям. «Когда вы начинаете наращивать мощности на уровне гигаватт и гигаватт, стоимость действительно имеет огромное значение. Если ускоритель, который справляется и с обучением, и с инференсом, потенциально будет на 30 % дороже, это становится совершенно неприемлемым», — отметил Сон.