Сегодня 30 апреля 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Китаю нужна своя OpenAI»: создатель популярного китайского поисковика выложил в открытый доступ мощную ИИ-модель Baichuan-13B

В феврале основатель китайской поисковой службы Sogou (входит в Tencent) Ван Сяочуань (Wang Xiaochuan) написал в соцсети Weibo, что «Китаю нужна своя OpenAI». С реализацией плана предприниматель затягивать не стал — его стартап Baichuan Intelligence создал и выложил в открытый доступ большую языковую модель искусственного интеллекта Baichuan-13B.

 Источник изображения: Gerd Altmann / pixabay.com

Источник изображения: Gerd Altmann / pixabay.com

Baichuan считается одним из наиболее многообещающих китайских разработчиков больших языковых моделей — основателем компании является выпускник Университета Цинхуа, который создал поисковую службу Sogou, впоследствии поглощённую местным технологическим гигантом Tencent. Ван покинул Sogou в конце 2021 года. Когда платформа ChatGPT уже стала мировой сенсацией, бизнесмен запустил стартап Baichuan и оперативно собрал инвестиции на $50 млн.

Как следует из названия, обученная на китайском и английском большая языковая модель Baichuan-13B на архитектуре Transformer (она же лежит в основе GPT) имеет 13 млрд параметров — переменных, которые используются при генерации текста. Исходный код платформы выложен на GitHub и оптимизирован для коммерческого использования. Baichuan-13B обучена на 1,4 трлн токенов — для сравнения, модель Meta LlaMa с теми же 13 млрд параметров была обучена на 1 трлн токенов.

Стартап Baichuan развивается с неимоверной скоростью. Открывшаяся в апреле компания к концу месяца расширила штат до 50 человек, а в июне опубликовала первую большую языковую модель Baichuan-7B с 7 млрд параметров. Новая Baichuan-13B доступна бесплатно для учёных и разработчиков, получивших разрешение на её использование в коммерческих целях. Стоит отметить, создатели учли введённые США антикитайские санкции, и модель можно запускать на системах с комплектующими потребительского класса, включая видеокарты NVIDIA GeForce RTX 3090.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
M1Cloud предложил частные облака для среднего и крупного бизнеса 22 мин.
SpaceX начала предлагать терминалы Starlink всего за $1, но всего на месяц 22 мин.
Разработчик ИИ-чипов для ЦОД и периферийных систем Blaize получил на развитие $106 млн 25 мин.
Крупнейших сотовых операторов США оштрафовали за торговлю данными о местоположении абонентов 26 мин.
Китайский телескоп «Зонд Эйнштейна» прислал первые пробные снимки —они впечатлили ученых деталями и находками 37 мин.
Глава AMD Лиза Су удостоилась титула «гендиректор года» от своих коллег 2 ч.
Слабый спрос на электромобили привёл к падению выручки NXP в автомобильном сегменте на 1 % 2 ч.
Прибыль Samsung Electronics взлетела на 933 % — производство памяти перестало приносить убытки 4 ч.
После предварительного одобрения FSD в Китае акции Tesla выросли в цене на 15 % 6 ч.
Новая статья: Он вам не силикон! Часть вторая: сила, блеск и двумерность 12 ч.