Сегодня 01 мая 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

«Больше, чем у кого-либо»: Цукерберг похвастался системой с более чем 100 тыс. Nvidia H100 — на ней обучается Llama 4

Среди американских IT-гигантов зародилась новая забава — соревнование, у кого больше кластеры и твёрже уверенность в превосходстве своих мощностей для обучения больших языковых моделей ИИ. Лишь недавно глава компании Tesla Илон Маск (Elon Musk) хвастался завершением сборки суперкомпьютера xAI Colossus со 100 тыс. ускорителей Nvidia H100 для обучения ИИ, как об использовании более 100 тыс. таких же ИИ-ускорителей сообщил глава Meta Марк Цукерберг (Mark Zuckerberg).

 Источник изображения: CNET/YouTube

Источник изображения: CNET/YouTube

Глава Meta отметил, что упомянутая система используется для обучения большой языковой модели нового поколения Llama 4. Эта LLM обучается «на кластере, в котором используется больше 100 000 графических ИИ-процессоров H100, и это больше, чем что-либо, что я видел в отчётах о том, что делают другие», — заявил Цукерберг. Он не поделился деталями о том, что именно уже умеет делать Llama 4. Однако, как пишет издание Wired со ссылкой на заявление главы Meta, их ИИ-модель обрела «новые модальности», «стала сильнее в рассуждениях» и «значительно быстрее».

Этим комментарием Цукерберг явно хотел уколоть Маска, который ранее заявлял, что в составе его суперкластера xAI Colossus для обучения ИИ-модели Grok используются 100 тыс. ускорителей Nvidia H100. Позже Маск заявил, что количество ускорителей в xAI Colossus в перспективе будет увеличено втрое. Meta также ранее заявила, что планирует получить до конца текущего года ИИ-ускорители, эквивалентные более чем полумиллиону H100. Таким образом, у компании Цукерберга уже имеется значительное количество оборудования для обучения своих ИИ-моделей, и будет ещё больше.

Meta использует уникальный подход к распространению своих моделей Llama — она предоставляет их полностью бесплатно, позволяя другим исследователям, компаниям и организациям создавать на их базе новые продукты. Это отличает её от тех же GPT-4o от OpenAI и Gemini от Google, доступных только через API. Однако Meta всё же накладывает некоторые ограничения на лицензию Llama, например, на коммерческое использование. Кроме того, компания не сообщает, как именно обучаются её модели. В остальном модели Llama имеют природу «открытого исходного кода».

С учётом заявленного количества используемых ускорителей для обучения ИИ-моделей возникает вопрос — сколько электричества всё это требует? Один специализированный ускоритель может съедать до 3,7 МВт·ч энергии в год. Это означает, что 100 тыс. таких ускорителей будут потреблять как минимум 370 ГВт·ч электроэнергии — как отмечается, достаточно для того, чтобы обеспечить энергией свыше 34 млн среднестатистических американских домохозяйств. Каким образом компании добывают всю эту энергию? По признанию самого Цукерберга, со временем сфера ИИ столкнётся с ограничением доступных энергетических мощностей.

Компания Илона Маска, например, использует несколько огромных мобильных генераторов для питания суперкластера из 100 тыс. ускорителей, расположенных в здании площадью более 7000 м2 в Мемфисе, штат Теннесси. Та же Google может не достичь своих целевых показателей по выбросам углерода, поскольку с 2019 года увеличила выбросы парниковых газов своими дата-центрами на 48 %. На этом фоне бывший генеральный директор Google даже предложил США отказаться от поставленных климатических целей, позволив компаниям, занимающимся ИИ, работать на полную мощность, а затем использовать разработанные технологии ИИ для решения климатического кризиса.

Meta увильнула от ответа на вопрос о том, как компании удалось запитать такой гигантский вычислительный кластер. Необходимость в обеспечении растущего объёма используемой энергии для ИИ вынудила те же технологические гиганты Amazon, Oracle, Microsoft и Google обратиться к атомной энергетике. Одни инвестируют в разработку малых ядерных реакторов, другие подписали контракты на перезапуск старых атомных электростанций для обеспечения растущих энергетических потребностей.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Датамайнер: разработка Half-Life 3 вышла на финишную прямую, а анонс не заставит себя долго ждать 17 мин.
ИИ-стартапы начали показывать рекламу Google в переписке с чат-ботами 53 мин.
Дорожное приключение Keep Driving получило первое крупное обновление и порадовало создателей продажами — поддержка русского языка на подходе 2 ч.
Microsoft наконец-то ускорила «Проводник» в Windows 11 24H2 2 ч.
Новое поколение платформы Beeline Cloud 2.0 дополнилось функцией интеллектуальной оркестрации гибридного облака 3 ч.
В Hollow Knight: Silksong можно будет сыграть в сентябре, но лишь посетителям австралийского музея 3 ч.
Nival выложила в открытый доступ исходный код культовой российской стратегии «Блицкриг» 5 ч.
Apple предупредила владельцев iPhone в ста странах об атаке шпионского ПО 5 ч.
Ежемесячная аудитория WhatsApp превысила 3 миллиарда пользователей 5 ч.
Microsoft представила три новые малые ИИ-модели семейства Phi-4 6 ч.
Российские и немецкие учёные разогнали оптический транзистор до 240 ГГц 8 мин.
Asus представила Radeon RX 9070 GRE в исполнении ATS Megalodon 2 ч.
Учёные разработали первую в мире экологически чистую технологию нанесения серебра в электронике 2 ч.
Huawei начала поставлять клиентам ИИ-кластеры CloudMatrix 384 — они мощнее, чем Nvidia GB200 NVL72 2 ч.
Глава Nvidia призвал Трампа смягчить экспортные ограничения на ИИ-чипы 2 ч.
Schneider Electric наращивает выручку благодаря спросу на решения для ЦОД 3 ч.
8BitDo прекратила поставки периферии в США из-за тарифной политики Трампа 4 ч.
Microsoft анонсировала резкое подорожание Xbox Series X и S по всему миру — главные игры Xbox теперь будут стоить 80 долларов 5 ч.
Совет директоров Tesla утверждает, что не ищет замену Маску и верит в его «потрясающий план роста» 5 ч.
Qualcomm резко нарастила продажи чипов, но слабый прогноз на будущее разочаровал инвесторов 9 ч.
Включить темный режим