Сегодня 20 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила TranslateGemma — семейство открытых ИИ-моделей для локального перевода на 55 языков

Компания Google выпустила три версии ИИ-модели TranslateGemma для обеспечения перевода на десятки языков на портативных и мобильных устройствах. Версия алгоритма с 4 млрд параметров оптимизирована для работы на мобильных устройствах, вариант с 12 млрд параметров предназначен для использования в потребительских ноутбуках, а версия с 27 млрд параметров — в облачных серверах, работающих на базе одного графического ускорителя H100 или тензорном процессоре.

 Источник изображений: Google

Источник изображений: Google

Google протестировала новые алгоритмы на платформе MetricX, которая позволяет отслеживать ошибки при переводе (чем ниже балл, тем лучше). Модель TranslateGemma с 12 млрд параметров набрала 3,6 балла, превзойдя результат базовой версии Gemma 3 с 27 млрд параметров, которая в этом тесте набрала 4,04 балла. По сравнению с версией Gemma 3 на 12 млрд параметров, набравшей на MetricX 4,86 балла, уровень ошибок снизился примерно на 26 %. Существенные улучшения в плане качества перевода наблюдаются для всех 55 протестированных языковых пар, включая не самые популярные языки. Так количество ошибок при переводе с английского на исландский снизилось на 30 %, а на суахили — на 25 %.

Двухэтапное обучение алгоритмов позволяет переносить знания Gemini в более компактные модели. На первом этапе алгоритмы обучаются на параллельных данных — как переведённых людьми, так и сгенерированных другими нейросетями. На втором этапе качество перевода оптимизируется за счёт обучения с подкреплением, когда несколько нейросетей автоматической оценки проверяют данные без необходимости использования эталонных переводов от человека. Отдельная модель оценивает, насколько естественно звучит полученный перевод.

Чтобы сохранить универсальность моделей, несмотря на их специализацию, 30 % обучающей выборки составили общие данные. Это означает, что модели TranslateGemma могут работать подобно привычным чат-ботам. Оценка профессиональными переводчиками в целом подтвердила улучшения, за одним исключением: в переводах с японского на английский было отмечено ухудшение качества, которое Google связывает с ошибками при обработке имён собственных.

Все три ИИ-модели сохранили мультимодальные возможности Gemma 3. Они могут переводить текст с изображений, даже без дополнительного обучения. Тесты в бенчмарке Vistra показали, что улучшения в переводе текста распространяются и на перевод с изображений. Для достижения оптимального результата Google рекомендует использовать промпты, указывающие модели на то, что она должна действовать как «профессиональный переводчик», учитывающий разные культурные нюансы. Все три новые модели TranslateGemma доступны на платформах Kaggle и Hugging Face.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В YouTube появился ИИ-поиск по роликам и генератор Shorts на базе Gemini Omni 2 ч.
Google выпустила Gemini Omni — ИИ для генерации видео из текста, фото, аудио и любых других данных 3 ч.
«Sims, твои дни сочтены»: новый геймплей амбициозного симулятора жизни Paralives впечатлил фанатов жанра 4 ч.
Microsoft отказывается от двухфакторной аутентификации по SMS в пользу ключей доступа 5 ч.
Google представила Gemini 3.5 Flash — сверхбыстрая ИИ-модель уже доступна бесплатно 6 ч.
Forza Horizon 6 только вышла, а уже обогнала по пиковому онлайну в Steam все другие игры Xbox 7 ч.
Запустится даже на картошке: хардкорный ролевой боевик Outward 2 получил дату выхода в раннем доступе Steam и системные требования 8 ч.
Apple представила ИИ-функции для инвалидов — включая управление коляской взглядом 8 ч.
VMware представила превью гипервизора ESXi-Arm Fling для Arm-серверов 9 ч.
Perplexity урезала лимиты для некоторых пользователей из-за злоупотреблений с промокодами 9 ч.
NASA испытает первые космические «заправки» для полётов к Луне и Марсу 2 ч.
Sony выпустила юбилейные наушники WH-1000X The ColleXion за $650 с шумоподавлением и урезанной автономностью 3 ч.
Новая статья: Обзор игрового ноутбука MSI Stealth 16 AI+ B3W: не размениваться на мелочи 3 ч.
До 84 ядер и 384 Мбайт L3-кеша: AMD опубликовала подробности о телеком-процессорах EPYC 8005 (Sorano) 4 ч.
Samsung объявила о старте продаж новых мониторов Odyssey и ViewFinity — вплоть до 6K 5 ч.
«Обезгугленные» TPU: Blackstone и Google развернут 500-МВт облако с фирменными ИИ-ускорителями Google без участия Google Cloud 5 ч.
Учёные решили головоломную задачу полётов ко множеству астероидов с минимальным расходом топлива 5 ч.
Microsoft представила очень дорогие планшеты Surface Pro 12 и ноутбуки Surface Laptop 8 на процессорах Intel Panther Lake 5 ч.
YADRO представила российский 2U-сервер Vegman R215 G4 на базе AMD EPYC Turin 7 ч.
Солнечная энергетика обгонит уголь и газ в 2030-х, но ИИ не даст отказаться от ископаемого топлива 7 ч.