Meta✴ заставит ИИ работать дешевле — фирменные ускорители потеснят Nvidia в ЦОД уже в 2027 году

Читать в полной версии

Meta Platforms планирует начать использование новых ИИ-ускорителей собственной разработки в центрах обработки данных в первой половине следующего года. В компании заявили, что это позволить сэкономить денежные средства и энергию при работе с ИИ-моделями.

Источник изображений: Meta

Впервые о планах по созданию собственных ИИ-ускорителей Meta объявила ещё в 2023 году. В настоящее время проходит тестирование третьего поколения ускорителей линейки — MTIA 450 (Meta Training and Inference Accelerator, он же Arke). Проектирование следующего ускорителя MTIA 500, который разрабатывается под кодовым именем Astrid, завершится примерно через месяц, а его эксплуатация в центрах обработки данных начнётся в конце следующего года.

«С каждым новым ускорителем мы берём на себя чуть больший технологический риск и получаем более высокую производительность», — прокомментировал данный вопрос вице-президент Meta по инженерным вопросам Йи Джун Сон (Yee Jiun Song). По его словам, речь идёт о повышении производительности на каждый затраченный ватт энергии и на каждый потраченный доллар.

Meta, являющаяся владельцем Facebook, Instagram и WhatsApp, разрабатывает собственные ускорители в рамках реализации масштабной программы по созданию обширной ИИ-инфраструктуры. В части проектирования гигант соцсетей сотрудничает с Broadcom, а в области производства — с TSMC. Этот проект призван снизить зависимость Meta от продукции Nvidia, которая является лидером в сфере разработки ИИ-ускорителей.

Если оценивать по энергопотреблению, ключевому показателю для индустрии ИИ-ЦОД, Meta планирует в течение года задействовать ускорителей, суммарной мощностью более гигаватта. После этого, по словам Сона, который курирует программу Meta по разработке собственных чипов, «ожидается ускорение темпов». Он добавил, что такой прогноз будет актуальным при условии, что не произойдёт обвала рынка ИИ или падения спроса.

MTIA 450 / Источник изображения: Meta

ИИ-подразделение Meta Superintelligence Labs помогает дорабатывать будущие ИИ-ускорители. Разработчики предоставляют информацию о будущих ИИ-моделях и требованиях к оборудованию для их запуска. Сон отметил, что такой подход помогает делать ускорители при запуске ИИ-моделей более эффективными, чем «то, что сейчас поставляет Nvidia». По его словам, это происходит «просто потому, что мы сами выполняем большую часть инженерной работы».

По данным источника, TSMC передала Meta 12 новых ускорителей 1 сентября. Их производительность соответствует прогнозам и отклоняется всего на 2-3 % от результатов симуляций. В тот же день инженеры задействовали ускорители для работы с ИИ-моделями Meta, а также алгоритмами от DeepSeek и Alibaba.

Первичные тесты показали, что в конструкции новых ускорителей нет проблем. Однако впереди ещё много работы, связанной с испытанием и настройкой новых устройств. Это займёт несколько месяцев, а параллельно будет наращиваться объём производства ИИ-ускорителей. Все четыре поколения ускорителей Meta в основном используют память с высокой пропускной способностью и не рассчитаны на сегмент, где от ИИ-моделей ожидается предельно быстрая реакция. «Это рабочие лошадки, которые мы планируем использовать для инференса общего назначения», — рассказал Сон.

Ранее компания планировала использовать ИИ-ускорители, которые разрабатывались под кодовым именем Olympus и которые должны были подходить для обучения ИИ-моделей, а также для инференса. Ускоритель должен был появиться в 2028-2029 годах, но Meta отказалась от этого проекта, в том числе по финансовым соображениям. «Когда вы начинаете наращивать мощности на уровне гигаватт и гигаватт, стоимость действительно имеет огромное значение. Если ускоритель, который справляется и с обучением, и с инференсом, потенциально будет на 30 % дороже, это становится совершенно неприемлемым», — отметил Сон.