Сегодня 02 апреля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи из AI2 вместе c AMD и другими создадут научную нейросеть

Институт искусственного интеллекта Пола Аллен (AI2) в 2024 году планирует выпустить большую языковую модель Open Language Model (OLMo), ориентированную на научные изыскания. OLMo разрабатывается в сотрудничестве с AMD, консорциумом Large Unified Modern Infrastructure, который предоставляет суперкомпьютерные мощности для обучения и образования, а также Surge AI и MosaicML, которые предоставляют данные и обучающий код.

 Источник изображения: pixabay

Источник изображения: pixabay

Ханна Хаджиширзи (Hanna Hajishirzi), старший директор по нейролингвистическим исследованиям (НЛП) в AI2, заявила, что «исследовательским и технологическим сообществам нужен доступ к открытым языковым моделям для продвижения науки. С OLMo мы работаем над устранением разрыва между государственными и частными исследовательскими возможностями и знаниями путём создания конкурентоспособной языковой модели». По мнению Хаджиширзи, несмотря на то, что многие модели с открытым исходным кодом на сегодняшний день привнесли новый опыт и даже «раздвинули границы», они не были специфично ориентированы.

AI2 рассматривает OLMo как платформу, а не просто очередную ИИ-модель и по словам Хаджиширзи, всё, что AI2 делает для OLMo, будет общедоступно, включая датасет и API. Другое отличие OLMo, по словам Ноа Смита (Noah Smith), старшего директора по исследованиям НЛП в AI2, заключается в том, чтобы позволить модели лучше использовать и понимать учебники и академические статьи. Заметим, что это не первая попытка сделать научную нейросеть. Например, печально известная модель Galactica от Meta. Однако Хаджиширзи считает, что обучение AI2 в академических кругах и инструменты, разработанные учёными для исследований, такие как Semantic Scholar, помогут сделать OLMo «уникально подходящей» для научных и академических приложений.

Обучение должно начаться в ближайшие месяцы на суперкомпьютере LUMI в Финляндии — самом быстром суперкомпьютере в Европе по состоянию на январь. AI2 приглашает сотрудников помочь внести свой вклад и критически оценить процесс разработки модели. Желающие могут связаться с организаторами на странице проекта OLMo.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Картинки в стиле Ghibli перегрузили серверы OpenAI — выпуск новых функций замедлен 6 ч.
У Ubisoft пока нет чёткого плана работы новой компании с Tencent — инвесторы и сотрудники нервничают 7 ч.
«Загрузки быстрее, чем в Doom (2016)»: эксперт Digital Foundry остался в восторге от Doom: The Dark Ages 8 ч.
Консоли задержат релиз постапокалиптического стелс-экшена Steel Seed от создателей Close to the Sun — объявлена новая дата выхода 10 ч.
Всего за несколько дней в Atomfall сыграло более 1,5 миллиона человек — это лучший старт в 32-летней истории разработчиков 11 ч.
ИИ-модель Llama запустили на ПК из прошлого тысячелетия на базе Windows 98 11 ч.
Nintendo подтвердила рекордную продолжительность презентации Switch 2 и устроит две демонстрации игр для консоли 11 ч.
ChatGPT остаётся самым популярным чат-ботом с ИИ, но у конкурентов аудитория тоже растёт 12 ч.
Google сделает сквозное шифрование в Gmail доступным для всех 12 ч.
Антиутопия на колёсах: новый геймплейный трейлер раскрыл дату выхода приключения Beholder: Conductor про кондуктора легендарного поезда 13 ч.