Сегодня 20 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

AMD выпустила свою первую языковую модель ИИ — AMD-135M

Поскольку AMD пытается нарастить своё присутствие на рынке ИИ, производитель выпускает не только аппаратное обеспечение под эти нужды, но также решил заняться разработкой языковых моделей. Результатом этого стал анонс первой малой языковой AMD-135M.

 Источник изображения: AMD

Источник изображения: AMD

Новая малая языковая модель AMD-135M принадлежит к семейству Llama и нацелена на развёртывание в частном бизнесе. Неясно, имеет ли новая ИИ-модель AMD какое-либо отношение к недавнему приобретению компанией стартапа Silo AI (сделка ещё не завершена и пока не одобрена различными регуляторами, поэтому, вероятно, нет). Однако это явный шаг в направлении удовлетворения потребностей конкретных клиентов с помощью предварительно обученной модели, созданной AMD с использованием её же оборудования.

Преимущество языковой модели AMD заключается в том, что она использует так называемое спекулятивное декодирование. Последнее представляет собой меньшую «черновую модель», которая генерирует несколько токенов-кандидатов за один прямой проход. Затем токены передаются в более крупную, более точную «целевую модель», которая проверяет или исправляет их. С одной стороны, такой подход позволяет генерировать несколько токенов одновременно, но с другой стороны, это приводит к повышению потребляемой мощности за счёт увеличения передачи данных.

Языковая модель AMD представлена в двух версиях: AMD-Llama-135M и AMD-Llama-135M-code. Каждая из них оптимизирована для определённых задач путём повышения производительности вывода с помощью технологии спекулятивного декодирования. Базовая модель AMD-Llama-135M была обучена с нуля на базе 670 млрд токенов общих данных. Этот процесс занял шесть дней с использованием четырех 8-канальных узлов на базе AMD Instinct MI250.

Модель AMD-Llama-135M-code в свою очередь была улучшена за счёт дообучения на базе дополнительных 20 млрд токенов, специально ориентированных на написание программного кода. Дополнительное обучение модели заняло четыре дня с использованием того же набора оборудования AMD. Компания считает, что дальнейшие оптимизации её моделей могут привести к дополнительному повышению их производительности и эффективности.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Календарь релизов — 20–26 июля: ZeroSpace, Avatar Legends: The Fighting Game и Scarlet Deer Inn 36 мин.
YouTube оставит ИИ-контент без монетизации — названы три категории видео, которые больше не будут приносить доход 46 мин.
Тодд Говард признался, что ворует идеи с Reddit 2 ч.
Приложение камеры Adobe Project Indigo получило набор генеративных фильтров и научилось удалять лишние объекты 4 ч.
The Life and Suffering of Prince Jerian от экс-разработчиков «Жизни и страданий господина Бранте» стартовала в Steam с «очень положительными» отзывами 5 ч.
Евросоюз оштрафовал Alibaba на рекордные €550 млн за торговлю запрещёнкой и контрафактом 5 ч.
Россияне сегодня столкнулись с недоступностью Apple App Store — «Роскомнадзор» заявил, что ни при чём 6 ч.
«Команда Doom наполовину на месте, а наполовину выброшена»: из id Software уволили две трети разработчиков Doom (2016) 7 ч.
Авторитетный инсайдер: руководители студий Xbox «абсолютно ненавидят» Game Pass, потому что сервис обесценивает игры 11 ч.
Компании начали проверять кандидатов на дипфейки — хакеры с ИИ всё чаще подсовывают «синтетических сотрудников» 11 ч.
Z.AI построила крупнейший дата-центр для ИИ исключительно на китайских чипах 50 мин.
Microsoft внедрит новейшую платформу AMD Helios AI в облако Azure 2 ч.
Google разрабатывает чип Frozen v2, на котором модели Gemini смогут работать эффективнее 5 ч.
Nebius заложила свои GPU. чтобы купить ещё GPU 5 ч.
Китайская CXMT начала тестировать чипы LPDDR6 — запуск массового производства запланирован на второе полугодие 6 ч.
Скоро появятся ноутбуки со сверхъяркими экранами Tandem OLED — Samsung начала массовые поставки 6 ч.
Британская Orcadian построит в Северном море автономный 200-МВт ЦОД — на природном газе и с захватом углерода 7 ч.
Спрос на GPU-инфраструктуру в России за год взлетел в шесть раз 8 ч.
Четыре плана «Б» и все провальные: запуск 2,45-ГВт ИИ ЦОД Project Jupiter для Oracle и OpenAI задержится из-за проблем с поставками газа 8 ч.
Стартап Reflection AI приобретёт вычислительные мощности Nebius на $1 млрд 10 ч.