Сегодня 14 января 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Для обучения ИИ-модели Google PaLM 2 использовали впятеро больше текстовых данных, чем для предыдущей

Анонсированная на прошлой неделе большая языковая модель Google PaLM 2 была обучена на объёме, который в пять раз превышает аналогичный показатель модели 2022 года. Это позволяет новой нейросети решать более сложные задачи по программированию, математике и написанию текстов, выяснили журналисты CNBC.

 Источник изображения: blog.google

Источник изображения: blog.google

При обучении Google PaLM 2 было использовано 3,6 трлн токенов — эти элементы обучения больших языковых моделей помогают нейросетям предсказывать последующие слова в последовательностях. Алгоритмы предсказания, в свою очередь, позволяют большим языковым моделям составлять связные фразы. Предыдущую её версию, Google PaLM, которая была выпущена в 2022 году, обучили на 780 млрд токенов.

На прошедшем мероприятии Google I/O компания активно демонстрировала возможности искусственного интеллекта при его интеграции в поиск, электронную почту, работу с текстовыми документами и электронными таблицами, но не сообщала подробностей об объемах обучающих данных. Аналогичной стратегии предпочла придерживаться компания OpenAI, недавно представившая GPT-4. Свои действия компании объясняют конкурентным характером бизнеса, а общественность настаивает на большей прозрачности в отношении ИИ.

Google всё же рассказала, что новая модель оказалась меньше предыдущих, то есть эффективность технологии при выполнении более сложных задач выросла. PaLM 2, согласно внутренним документам компании, обучена на 340 млрд параметров, тогда как у первой версии их было 540 млрд — это свидетельствует, что увеличилась сложность модели. В компании подтвердили, что PaLM 2 обучена сотне языков, и это позволяет ей интегрироваться в 25 функций и продуктов экосистемы Google, включая экспериментальный чат-бот Bard.

Google PaLM 2, если верить общедоступным данным, может оказаться мощнее всех существующих моделей. Для сравнения, анонсированная в феврале Meta LlaMA обучена на 1,4 трлн токенов; OpenAI, когда ещё делилась информацией, докладывала, что GPT-3 обучалась на 300 млрд токенов; а представленная ещё два года назад Google LaMDA была обучена на 1,5 трлн токенов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Из России с душой: создатели Sid Meier’s Civilization VII показали геймплей за Екатерину Великую 2 ч.
Microsoft сформирует команду ИИ-инженеров CoreAI для глубокого погружения в ИИ 3 ч.
«Сбер», «Альфа-банк» и «Т-Банк» объединились для развития платёжных сервисов и технологий 3 ч.
«Apple получает непомерную прибыль»: в Великобритании начался суд по делу о завышенной комиссии в App Store 4 ч.
Календарь релизов — 13–19 января: Hyper Light Breaker, Assetto Corsa Evo и Broken Alliance 5 ч.
SafeTech объявила о создании ST Crypt — новой компании на российском ИБ-рынке 5 ч.
Разработчики Baldur’s Gate 3 «полностью сосредоточены» на новой игре и готовят фанатов к информационной засухе 5 ч.
Российское подразделение Google хочет отсудить у рекламного агентства более 500 млн рублей 5 ч.
Генеративный ИИ от Google прописался в автомобилях Mercedes-Benz 5 ч.
«Смесь System Shock и Half-Life»: геймплейный трейлер мрачного шутера Deficit заинтриговал игроков 7 ч.
Новая статья: ИИтоги декабря 2024 г.: поступательно, без потрясений 2 ч.
Скандал с приложением Sonos достиг кульминации — гендир производителя аудиоустройств ушёл в отставку 2 ч.
Maxsun представила видеокарты GeForce RTX 5000 Mega Gamer с матричным дисплеем и другие новинки на чипах Blackwell 2 ч.
Полупроводниковая отрасль США раскритиковала новые ограничения на экспорт ИИ-чипов и ИИ-моделей 2 ч.
Игровую консоль Nintendo Switch 2 представят уже на этой неделе, но подробностей придётся подождать 5 ч.
Qualcomm разрабатывает серверные процессоры, доказала вакансия на сайте компании 7 ч.
Независимые обзоры GeForce RTX 5090 выйдут 24 января, а RTX 5080 — 30 января 8 ч.
Атомная энергетика поможет Великобритании стать ИИ-сверхдержавой, рассчитывают власти 8 ч.
От Intel отделился производитель систем машинного зрения RealSense 8 ч.
Соцсеть X готова потратить $1 млрд на ИИ-серверы HPE 8 ч.