Сегодня 13 октября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → seamlessm4t

Meta✴ научила ИИ-модель SeamlessM4T переводить текст и речь быстрее и естественнее

Meta обновила свою ИИ-модель SeamlessM4T, предназначенную для перевода речи и текста. Теперь платформа поддерживает переводы почти на 100 языках, включая русский, в текстовом формате и на 36 — в устной речи. С новой архитектурой решения технологический гигант стремится сделать перевод более естественным и выразительным, что обещает стать прорывом в коммуникациях между людьми и производстве контента.

 Источник изображения: ***

Источник изображения: Meta

Meta построила SeamlessM4T на основе своей архитектуры многофункциональной модели UnitY на базе PyTorch, которая выполняет различные модальные переводы, а также автоматическое распознавание речи. Она использует систему BERT 2.0 для аудиокодирования, разбивая входные данные на составляющие токены для анализа, и HiFi-GAN unit vocoder для генерации голосовых ответов.

Первая из двух новых функций SeamlessM4T называется SeamlessExpressive. Как можно понять из названия, она переносит эмоциональные интонации голоса в переведённую речь. Система учитывает такие составляющие, как тон речи, её громкость, эмоциональный окрас (возбуждение, печаль или шёпот), темп речи и паузы. Всё это делает переводы менее механическими и более живыми. Поддерживаются английский, испанский, немецкий, французский, итальянский и китайский языки.

Вторая функция, SeamlessStreaming, начинает переводить речь, пока говорящий ещё не закончил предложение, что позволяет другим слушателям быстрее услышать перевод. Задержка составляет чуть менее двух секунд. По словам Meta, основной трудностью здесь было различие в структуре предложений разных языков, поэтому был разработан специальный алгоритм, который анализирует неполные аудиофрагменты и решает, достаточно ли контекста для начала генерации перевода или стоит ещё послушать говорящего.

Как и большинство предыдущих разработок Meta в области машинного перевода, будь то Llama 2, Massively Multilingual Speech (MMS), Universal Speech Translator (UST) или амбициозный проект No Language Left Behind (NLLB), SeamlessM4T находится в открытом доступе на GitHub. «Мы считаем, что SeamlessM4T является важным прорывом в стремлении сообщества ИИ к созданию универсальных многофункциональных систем», — написала команда исследователей.

Развитие компанией Meta ИИ-технологий перевода с различных языков открывает новые перспективы в области межъязыкового общения. Эти инновации могут значительно превзойти существующие решения, такие как инструменты перевода, разработанные компаниями Google и Samsung. Пока нет точной информации о сроках внедрения Meta этих функций, но их потенциальное применение, например, в умных очках Meta, обещает сделать их незаменимыми в повседневной жизни и профессиональной сфере.


window-new
Soft
Hard
Тренды 🔥
AMD FSR 4, улучшения графики и оптимизации: для Black Myth: Wukong вышел первый за полгода новый патч 21 мин.
Журналисты показали, как волшебное приключение Everwild от авторов Sea of Thieves выглядело незадолго до отмены 44 мин.
OpenAI определила эпоху ИИ и стала уникальной компанией в истории Кремниевой долины 2 ч.
Warner Bros. так уверена в успехе «Мортал Комбат 2», что уже начала работу над «Мортал Комбат 3» 6 ч.
xAI будет создавать виртуальные миры для игр и обучения роботов 8 ч.
Пользователи ChatGPT снова могут удалять свои чаты безвозвратно 12-10 12:08
Арт-директор Halo покинул студию после 17 лет работы и намекнул на проблемы в команде разработчиков 12-10 10:33
Один из основателей ИИ-стартапа Thinking Machines переметнулся к Марку Цукербергу 12-10 08:17
Google запустила Nano Banana в AI Mode и «Google Объектив» 12-10 06:30
Apple завершила поддержку своего бесплатного видеоредактора Clips 12-10 06:28
Microsoft запустила новые облачные регионы в Малайзии и Индонезии и откроет дополнительные в Индии и на Тайване 34 мин.
«Инферит» представил российские 2U-серверы для ИИ на базе Intel Xeon Emerald Rapids 2 ч.
OpenAI растёт быстрее всех — но теперь никто не понимает, кому она принадлежит 2 ч.
Apple уже работает над новыми AirPods Pro и AirPods 5 — они получат чип H3 2 ч.
IBM представила ускоритель Spyre Accelerator для ИИ-инференса 3 ч.
Intel начала сворачивать поддержку ускорителей Ponte Vecchio и Arctic Sound — они вышли всего два года назад 3 ч.
Умные очки Apple будут работать в разных режимах при подключении к Mac и iPhone 4 ч.
Анонсирован защищённый смартфон Oukitel WP58 Pro с батареей на 10 000 мА·ч и двумя кемпинговыми фонариками 5 ч.
«Зелёные» надежды стали пеплом: американские ЦОД активно переходят на питание от угольных электростанций из-за спроса на ИИ 5 ч.
В TikTok завирусились розыгрыши с ИИ-фото бездомных — полиция призвала подростков остановиться 6 ч.