Сегодня 21 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Nvidia помогла Apple повысить эффективность больших языковых моделей ИИ

Инженеры Apple рассказали о сотрудничестве с Nvidia, благодаря которому им удалось повысить производительность систем при генерации текста большими языковыми моделями искусственного интеллекта.

 Источник изображения: developer.nvidia.com

Источник изображения: developer.nvidia.com

В этом году Apple опубликовала исходный код своего решения Recurrent Drafter (ReDrafter) — это новый метод генерации текста с помощью больших языковых моделей. Он отличается высокой скоростью работы, объединяя две технологии: лучевой поиск и динамическое древо внимания. Исследовательский проект Apple показал убедительные результаты, но при развёртывании ReDrafter технология была интегрирована в систему Nvidia TensorRT-LLM — этот инструмент позволяет быстрее запускать большие языковые модели на ускорителях Nvidia.

Как показали замеры производительности, при запуске больших языковых моделей с десятками миллиардов параметров с использованием фреймворка Nvidia TensorRT-LLM и ReDrafter скорость генерации токенов увеличилась в 2,7 раза. Таким образом, технология позволяет сократить задержку между вводом запроса пользователем и получением ответа от модели — при этом используется меньшее число ускорителей и снижается потребление энергии, сделали вывод инженеры Apple.

«Большие языковые модели всё чаще используются в работе приложений, и повышение эффективности вывода может повлиять на вычислительные издержки и сократить задержку для пользователей. Благодаря новому подходу ReDrafter к интегрированному во фреймворк Nvidia TensorRT-LLM спекулятивному выполнению разработчики теперь могут быстрее генерировать токены на ускорителях Nvidia для своих приложений», — добавили в Apple.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Warner Bros. Games вместо Injustice 3 анонсировала условно-бесплатный мобильный файтинг DCKO, и фанаты не рады 19 мин.
За консультантами в магазинах Apple проследит ИИ 22 мин.
OpenAI разработала ИИ для выполнения длительных задач, и тот вышел из-под контроля 32 мин.
Учёные нашли способ обрушить ИИ ЦОД и энергосеть через обычные вычисления 36 мин.
Обновлённый вариант ИИ-протокола MCP снизит нагрузку на серверы 40 мин.
«Кронус вновь будет наш»: новый трейлер Warhammer 40,000: Dawn of War 4 показал возвращение некронов 2 ч.
РТК-ЦОД запустил облачный мониторинг качества каналов связи для 20 тысяч объектов заказчиков «Ростелекома» 3 ч.
Anthropic выплатит авторам $1,5 млрд за «пиратскую библиотеку» для обучения Claude 4 ч.
Слухи: многострадальный ремейк Star Wars: Knights of the Old Republic скоро выйдет из тени 5 ч.
Activision подтвердила, когда пройдёт открытая «бета» Call of Duty: Modern Warfare 4 — подробности тестирования 5 ч.
Google создаёт ИИ-ускоритель Frozen v2, оптимизированный специально для Gemini 11 мин.
Китайцы в сто раз ускорили производство фотонных чипов методом ионно-лучевой литографии 23 мин.
В России стартовали продажи смартфона Honor X7e с долговечным аккумулятором на 7200 мА·ч — от 17 990 рублей 29 мин.
TSMC поднимет цены на выпуск чипов — на 5–10 % подорожают и передовые, и зрелые техпроцессы 30 мин.
Объёмы производства памяти CXMT выросли почти в 20 раз и приблизились к показателям Micron 30 мин.
ИИ и автопилот смогут раскрыть потенциал электромобилей, считают в Foxconn 34 мин.
Горе от ума: с новыми версиями FSD электромобили Tesla стали чаще нарываться на штрафы 38 мин.
Помогать OpenAI создавать роботов будет выходец из китайского автопроизводителя Xpeng 40 мин.
Samsung тоже захотела делать роботов — новое подразделение возглавил выходец из Hyundai 42 мин.
Chelsio представила 400GbE-решения седьмого поколения для ИИ ЦОД 2 ч.