Сегодня 04 сентября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI отказалась от энергоэффективной ИИ-модели Arrakis — её разработка зашла в необъяснимый тупик

Ответственная за нейросеть GPT-4 и службу ChatGPT компания OpenAI работала над новой моделью искусственного интеллекта Arrakis, которая предлагала более высокую эффективность и, соответственно, более низкую себестоимость обслуживания. Но проект пришлось приостановить из-за проблем с качеством.

 Источник изображения: Zac Wolff / unsplash.com

Источник изображения: Zac Wolff / unsplash.com

Предполагалось, что Arrakis будет иметь возможности, сравнимые с GPT-4, но окажется более дешёвой в развёртывании — её спроектировали с использованием так называемого принципа разрежённости. Это значит, что обработка входящих данных производится только частью нейросети, тогда как традиционные «плотные модели» задействуют все её участки. Принцип разрежённости используется, например, Google в проекте Pathways.

Разработка Arrakis началась прошлой осенью, а обучение модели начали этой весной. Но разработчики OpenAI быстро поняли, что система действует слишком медленно. В течение месяца они пытались произвести настройку модели, но затем руководство закрыло проект. Причины сбоя установить пока не удалось: принцип разрежённости хорошо работал в ранних тестах, но в более крупной модели проявить себя не сумел.

Несмотря на неудачу, OpenAI сможет использовать наработки Arrakis и мультимодальной модели Gobi в других проектах. Большие надежды на Arrakis возлагали и в Microsoft: сейчас софтверный гигант переключился на разработку менее дорогих языковых моделей, поскольку высокая себестоимость обслуживания генеративного ИИ начала угрожать её бизнесу.

Arrakis генерировала не только текст, но также изображения и видео; у неё было меньше галлюцинаций, чем у GPT-4; и она могла работать в качестве автономного агента. Модель была частично обучена на синтетических данных, а её выход планировался на 2024 год. Проект мог вылиться в целую систему создания более эффективных моделей — есть версия, что он способствовал разработке нейросети GPT-3.5 Turbo.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
RuStore и АКИ создадут экосистему для развития мобильных игр и «появления новых российских хитов на мировом рынке» 2 ч.
Релиз «Альт Рабочая станция» 11.1: шифрование по ГОСТ, расширенная поддержка видеокарт Nvidia, приложения собственной разработки 2 ч.
«Уже лучшая игра 2026 года для меня»: журналисты показали сражение с боссом в Nioh 3, и фанаты в восторге 3 ч.
Франция оштрафовала Google на €325 миллионов за нарушение требований по защите потребителей 3 ч.
Функция Projects в ChatGPT стала доступна бесплатным пользователям 4 ч.
Как шахматы, но быстрее: соавтор Nuclear Throne анонсировал странную пошаговую стратегию Australia Did It 4 ч.
Произошёл серьёзный сбой в работе сервисов Google 4 ч.
Присяжные в суде Сан-Франциско обязали Google выплатить более $425 млн за нарушение конфиденциальности 5 ч.
Отрасль затаила дыхание —Tesco, крупнейшая розничная сеть в Великобритании, подала в суд на Broadcom из-за изменения лицензионной политики VMware 7 ч.
Надёжный инсайдер: новая God of War в разработке, а Marvel’s Wolverine скоро выйдет из тени 7 ч.
Dreame представила концептуальный робот-пылесос Cyber X с гусеничной платформой 24 мин.
Dreame представила роботы-пылесосы Aqua10 Ultra Track с технологиями Nvidia и Matrix10 Ultra с автозаменой моющих насадок 24 мин.
Представлен рукастый робот-пылесос Dreame Cyber10 Ultra для очистки труднодоступных мест 25 мин.
ICL организовала производство модульных ЦОД DataCube 31 мин.
Google бросила вызов NVIDIA, предложив малым облачным провайдерам собственные ИИ-ускорители TPU 38 мин.
Belkin представила проводные наушники SoundForm USB-C ANC, а также три беспроводных модели по цене $34,99 53 мин.
SpaceX разрешили удвоить количество пусков ракет из Флориды 59 мин.
Американцы хотят полететь на Марс уже в начале 2030-х годов 2 ч.
Представлен Eufy MarsWalker — робот для подъёма и спуска роботов- пылесосов по лестницам 2 ч.
Учёные обучили промышленных роботов «балету», чтобы они не мешали друг другу при совместной работе 3 ч.