Сегодня 27 января 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

В Стэнфорде создали аналог ChatGPT всего за $600

Ученные Стэнфордского университета разработали модель искусственного интеллекта Alpaca AI, которая во многих задачах работает аналогично ChatGPT. Отличие состоит в том, что построили её на основе платформы с открытым исходным кодом, а обучение обошлось менее чем в $600. Иными словами, современные продвинутые системы ИИ можно легко воспроизвести, причём с довольно скромными затратами.

 Источник изображения: Gerd Altmann / pixabay.com

Источник изображения: Gerd Altmann / pixabay.com

Всего полгода назад за эволюцией больших языковых моделей следили разве что учёные и энтузиасты, но с запуском ChatGPT стало очевидным: машины могут общаться так же, как люди. Они за считаные секунды пишут тексты из множества предметных областей, зачастую демонстрируя очень высокий уровень. Последующий выход GPT-4 показал, что и развиваются они с головокружительной скоростью, обещая в скором времени коренным образом преобразовать всё человечество. Собственные аналоги уже есть у Google, Apple, Meta, Baidu и Amazon — ИИ-системы скоро наводнят рынок, появившись в поисковых системах, автомобилях и даже смарт-часах.

Как выяснилось, чтобы построить аналог ChatGPT, не нужно ресурсов технологического гиганта — достаточно определённой базы знаний и бюджета в $600. Это на деле подтвердили учёные Стэнфордского университета, взяв за основу разработанную Meta открытую языковую модель LLaMA 7B — самую доступную из линейки LlaMA. Будучи обученной на триллионе примеров, она обладает ограниченными возможностями и в большинстве задач значительно отстаёт от ChatGPT. Основные материальные затраты и главное конкурентное преимущество моделей OpenAI GPT заключаются в огромном количестве времени и человеческих ресурсов, которые разработчик вложил в обучение модели: одно дело прочитать несколько миллиардов книг и совсем другое — усвоить большое число пар вопросов и ответов, готовящих ИИ к предстоящей работе.

 Источник изображения: github.com/tatsu-lab

Источник изображения: github.com/tatsu-lab

Запустив модель LLaMA 7B, учёные Стэнфорда дали GPT образец из созданных человеком пар вопросов-ответов и предписали ей генерировать по этому образцу новые данные, выдавая по 20 пар за итерацию. Автоматизировав задачу через открытые OpenAI средства OpenAI, они за короткое время получили в распоряжение 52 000 образцов диалога, подходящих для обучения LlaMA, что обошлось учёным менее чем в $500. Далее последовал этап тонкой настройки LlaMA — для этого потребовались ресурсы восьми компьютеров с 80-Гбайт ускорителями NVIDIA A100 на три часа. В облачной инфраструктуре эта услуга обошлась менее чем в $100. По окончании обучения исследователи протестировали свою модель, которой дали имя Alpaca, и сравнили её с ChatGPT в таких задачах как написание электронной почты, публикаций для соцсетей и помощь в работе. Alpaca успешно справилась с 90 тестами, а ChatGPT преодолел лишь 89.

Авторы проекта отметили, что, вероятно, могли бы достичь того же результата с меньшими материальными затратами, если бы поставили цель оптимизировать процесс. При наличии доступа к GPT-4 и более мощным моделям LlaMA, которые можно взять за основу, любой подготовленный специалист смог бы повторить опыт и даже достичь более весомых результатов, не останавливаясь на 52 000 пар вопросов и ответов, тем более, что свой набор учёные Стэнфорда опубликовали на Github. Они также предупредили, что пока не занимались важнейшим из вопросов для современных ИИ — не провели дополнительной тонкой настройки, чтобы обеспечить безопасную и этичную работу модели, поэтому тех, кто будет использовать их наработки, попросили сообщать о выявленных сбоях.

Повторить опыт стэнфордских учёных теоретически может любой желающий при наличии технической подготовки и суммы в $600, однако остаются некоторые препятствия. Лицензия OpenAI не разрешает использовать данные её моделей для разработки конкурирующих систем, а Meta пока разрешила академическим исследователям пользоваться только некоммерческими лицензиями — виной всему утечка LlaMA на имиджборд 4chan через неделю после анонса. С другой стороны, ещё одна сторонняя группа разработчиков нашла способ запустить Alpaca AI на одноплатных компьютерах Raspberry Pi с возможностью масштабирования до более продвинутых LlaMA-13B, 30B и 65B и не прибегать в услугам облачных провайдеров на этапе тонкой настройки — достаточно ресурсов всего одной бытовой, пусть и чрезвычайно мощной видеокарты NVIDIA GeForce RTX 4090 на пять часов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Microsoft снова сломала Windows 11 — с обновлением перестали работать наушники, веб-камеры и даже Alt+Tab 24 мин.
У Hogwarts Legacy на ПК скоро появится официальная поддержка модов и редактор для их создания 37 мин.
Продажи игр на физических носителях в США неуклонно снижаются — с 2021 года более чем вдвое 2 ч.
Ролевой боевик Rise of the Ronin от создателей Nioh выйдет на ПК с поддержкой 8K и 120 кадров/с — дата релиза в Steam и геймплейный трейлер 3 ч.
Биткоин провалился ниже $98 тыс. после обвала акций американских ИИ-компаний 3 ч.
Инсайдер рассекретил Doom: The Dark Ages для Nintendo Switch 2, а Microsoft пообещала поддерживать консоль своими играми 7 ч.
Гендиректор Epic Games подтвердил, что Alan Wake 2 не выйдет в Steam 8 ч.
Почти все крупные компании в России используют облачные сервисы 8 ч.
Россия опустилась 8-е место в мире по количеству DDoS-атак в 2024 году 9 ч.
Неанонсированный ремейк The Elder Scrolls IV: Oblivion подтвердил ещё один источник — релиз уже скоро 9 ч.
Индийская Reliance заявила, что построит «крупнейший ЦОД в мире» 2 ч.
Китайские роботы UBTech начнут заполнять заводы и фабрики уже в этом году 2 ч.
Nothing раскрыла дату анонса Phone (3) — ждать настоящий флагман осталось недолго 2 ч.
2 тыс. игроков ИТ-рынка обсудят «хайповые» и проверенные временем технологии 13 февраля в Москве 4 ч.
До 2030 года AWS вложит $8,3 млрд в облачную инфраструктуру в Мумбаи 5 ч.
Китайский ответ Stargate: КНР вложит в развитие ИИ 1 трлн юаней 6 ч.
Латвия и Швеция расследуют повреждение очередного кабеля в Балтийском море, арестовано судно, следовавшее из российской Усть-Луги 8 ч.
Tesla в этом году нарастит продажи электромобилей всего на 16 %, считают аналитики — Маск верит в лучшее 8 ч.
В Китае Tesla отзовёт более 1,2 млн электромобилей, у которых могут выходить из строя бортовые компьютеры 12 ч.
Xiaomi успела поставить клиентам 150 000 электромобилей SU7 16 ч.