Сегодня 24 февраля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила компактную языковую модель Gemma 2 2B, которая превосходит GPT 3.5 Turbo

Компания Google представила Gemma 2 2B — компактную, но мощную языковую модель искусственного интеллекта (LLM), которая может составить конкуренцию лидерам отрасли, несмотря на свой значительно меньший размер. Новая языковая модель, содержащая всего 2,6 миллиарда параметров, демонстрирует производительность не хуже гораздо более крупных аналогов, включая OpenAI GPT-3.5 и Mistral AI Mixtral 8x7B.

 Источник изображений: Google

Источник изображений: Google

В тесте LMSYS Chatbot Arena, популярной онлайн-платформы для сравнительного тестирования и оценки качества моделей искусственного интеллекта, Gemma 2 2B набрала 1130 баллов. Этот результат немного опережает результаты GPT-3.5-Turbo-0613 (1117 баллов) и Mixtral-8x7B (1114 баллов) — моделей, обладающих в десять раз большим количеством параметров.

Google сообщает, что Gemma 2 2B также набрала 56,1 балла в тесте MMLU (Massive Multitask Language Understanding) и 36,6 балла в тесте MBPP (Mostly Basic Python Programming), что является значительным улучшением по сравнению с предыдущей версией.

Gemma 2 2B бросает вызов общепринятому мнению, что более крупные языковые модели изначально работают лучше компактных. Производительность Gemma 2 2B показывает, что сложные методы обучения, эффективность архитектуры и высококачественные наборы данных могут компенсировать недостаток в числе параметров. Разработка Gemma 2 2B также подчеркивает растущую важность методов сжатия и дистилляции моделей ИИ. Возможность эффективно компилировать информацию из более крупных моделей в более мелкие открывает возможности к созданию более доступных инструментов ИИ, при этом не жертвуя их производительностью.

Google обучила Gemma 2 2B на огромном наборе данных из 2 триллионов токенов, используя системы на базе своих фирменных ИИ-ускорителей TPU v5e. Поддержка нескольких языков расширяют её потенциал для применения в глобальных приложениях. Модель Gemma 2 2B имеет открытый исходный код. Исследователи и разработчики могут получить доступ к модели через платформу Hugging Face. Она также поддерживает различные фреймворки, включая PyTorch и TensorFlow.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google предложит музыкантам ИИ-продюсера вместо генератора случайных мелодий — компания поглотила ProducerAI 30 мин.
Marvel’s Wolverine выйдет до GTA VI — Sony подтвердила дату релиза жестокого боевика от создателей «Человека-паука» 2 ч.
Blizzard анонсировала новую Overwatch, но это мобильная игра — первый геймплей и подробности Overwatch Rush 3 ч.
Death Stranding 2: On the Beach оптимизируют даже для бюджетных ПК — объявлены системные требования 4 ч.
Противоречивого бота xAI Grok допустят к секретным военным системам США 4 ч.
Amazon закроет кооперативный платформер King of Meat спустя полгода после релиза — рассчитывали на 100 тысяч игроков, а получили 320 (не тысяч) 5 ч.
«Притворяться было бы ужасной идеей»: глава Microsoft Gaming ответила на подозрения игроков 5 ч.
Бобровая градостроительная стратегия Timberborn выйдет из раннего доступа позже обещанного, потому что «бобры очень вежливы» 9 ч.
Создатель Kingdom Come: Deliverance променял разработку игр на кино по Kingdom Come: Deliverance 10 ч.
«Молюсь, чтобы ты ошибался»: инсайдер раскрыл главную игру мартовской подборки PS Plus, и фанаты не рады 10 ч.
Новая керамическая электроника откроет путь к возвращению на Венеру — не на часы, а на дни и недели 18 мин.
SanDisk представила портативные SSD со скоростью до 4000 Мбайт/с и объёмом до 8 Тбайт 3 ч.
Тим Кук признался, что «спал с одним открытым глазом» после секретного брифинга ЦРУ о Тайване и TSMC 3 ч.
В США нашли замену полупроводниковым лазерам — это особые microLED толщиной с волос 3 ч.
Xiaomi выпустила шестёрку мониторов для геймеров и не только — от 24 до 34 дюймов по цене от $70 3 ч.
Meta купит у AMD чипов на $100 млрд для ИИ-систем на 6 ГВт — и получит «в подарок» кусочек самой AMD 3 ч.
ИИ даст толчок сверхпроводимости — но без технологического прорыва и не там, где все ждали 4 ч.
Dell и Lenovo могут первыми выпустить ноутбуки на Arm-процессоре Nvidia N1 5 ч.
Российский рынок модульных ЦОД в 2025 году вырос на 20 % 5 ч.
Энтузиаст построил VR-гарнитуру на базе ЭЛТ-мониторов — она оказалась на удивление удобной 5 ч.