Сегодня 22 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила очень быструю открытую ИИ-модель DiffusionGemma, которая принципиально отличается от других

Google выпустила экспериментальную модель искусственного интеллекта DiffusionGemma, в которой при генерации текста используется принципиально иной подход по сравнению с моделями, на которых работает большинство современных чат-ботов.

 Источник изображений: blog.google

Источник изображений: blog.google

Вместо того, чтобы генерировать слово за словом в строгой последовательности, она создаёт за один раз целый блок текста и продолжает его дорабатывать, пока он не станет читаемым. Основное преимущество DiffusionGemma в том, что приоритетом для неё является скорость, даже за счёт некоторой потери качества конечного результата. Модель опубликована с открытым исходным кодом под лицензией Apache 2.0 и ориентирована на разработчиков и исследователей, а не обычных пользователей.

Ответ на запрос пользователей она начинает с набора случайных токенов — шумного, нечитаемого текста, который за несколько проходов превращается в осмысленный. Это позволяет существенно увеличить скорость по сравнению с традиционными вариантами: на ускорителе Nvidia H100 генерируются по 1000 токенов в секунду, а на потребительской видеокарте — по 700 токенов в секунду.

Google DiffusionGemma имеет архитектуру «смеси экспертов» (Mixture-of-Experts), то есть при размере 26 млрд параметров одновременно активными остаются лишь 3,8 млрд; для работы модели требуются около 18 Гбайт видеопамяти. За один шаг она генерирует 256 токенов, и все они взаимодействуют внутри блока. Это даёт модели глобальное представление о результатах, а не строго линейное.

Она хорошо подходит для задач на структурирование или выполнение правил: её можно использовать для заполнения недостающих фрагментов кода, работы с форматами вроде JSON, решения сложных логических задач и обработки математических закономерностей. Видя блок токенов сразу, она может исправлять противоречия в одном цикле генерации, а не ждать, когда ошибку исправит более поздний токен.

Но есть у неё существенный минус. Ответы Google DiffusionGemma по качеству уступают ответам Gemma 4 – пользователь получает скорость в ущерб точности. Поэтому Google позиционирует проект как экспериментальный — он разработан для сценариев, при которых скорость ответа важнее совершенства. Например, для работы приложений ИИ в реальном времени, для встроенных помощников по написанию текста или кода и других быстрых итеративных рабочих процессов. Заменой моделей семейств Gemma и Gemini она быть не может.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Substack начал помечать публикации, написанные ИИ — чтобы защититься от «гонки на выживание» 60 мин.
Max обошёл Telegram по месячной аудитории, но её прирост почти остановился 2 ч.
Electronic Arts подтвердила дату анонса и главную звезду EA Sports FC 27 3 ч.
Darkest Dungeon спустя 10 лет после релиза получит дополнение с персонажами из Darkest Dungeon 2 — подробности The Fire's Edge 5 ч.
Gemini 3.5 Pro снова не вышла: Google представила облегчённые Gemini 3.6 Flash и Flash-Lite 5 ч.
Дуров анонсировал «крупнейший в истории человечества» запуск криптокошелька — Gram встроят в Telegram 5 ч.
Chrome научился заполнять формы с помощью Gemini по данным из Gmail и «Google Фото» — пока в тестовом режиме 6 ч.
Психологический триллер Lost in the Roots от авторов No, I’m not a Human выйдет «совсем скоро» — сюжетный трейлер и запись на тестирование в Steam 6 ч.
Microsoft устранила несовместимость компьютеров Dell с последним обновлением Windows 7 ч.
Госдума приняла закон «О цифровых валютах и цифровых правах» 7 ч.
Новая статья: Обзор «малолитражного суперкомпьютера» MSI EdgeXpert MS-C931 56 мин.
Сделано в США: сетевые ASIC Fortinet SP6 будут выпускаться на американских фабриках Intel 2 ч.
Продажи Steam Deck обвалились после недавнего повышения цен 2 ч.
Лунный корабль «посветит» лазерами на спутники SpaceX Starlink в рамках Artemis III 3 ч.
Nvidia раскрыла детали процессора Vera: 88 Arm-ядер Olympus, 176 потоков и память LPDDR5X с пропускной способностью 1,2 Тбайт/с 3 ч.
xMEMS представила твердотельный кулер размером с ноготь для умных очков 5 ч.
Не только GPU: Nvidia всерьёз взялась за рынок CPU и уже отгрузила сотни тысяч серверов 5 ч.
Астрономы впервые обнаружили двойную звёздную систему, где обе звезды взорвались как сверхновые 6 ч.
Nvidia повысила цены на все компьютеры и модули Jetson — в некоторых случаях вдвое 6 ч.
Американские ИИ-гиганты задолжали гораздо больше, чем отражено в их отчётности — обязательств набралось уже на $1,65 трлн 7 ч.